产业与商业

DesignArena 融资 790 万美元:AI 设计评测平台押注“品味”成为新一代基础设施

DesignArena 背后的 Intelligence 完成 790 万美元种子轮融资,Claim 拥有约 530 万用户和 6000 万美元 ARR,主打将用户对设计审美的偏好转化为可量化、可训练的数据,成为面向创意和界面生成模型的评测与数据基础设施。文章讨论了其商业模式、竞争格局与未来挑战,包括数据货币化的可持续性和评测体系的抗操控问题。

DesignArena 融资 790 万美元:AI 设计评测平台押注“品味”成为新一代基础设施

DesignArena 背后的 Intelligence 完成 790 万美元种子轮融资,Claim 拥有约 530 万用户和 6000 万美元 ARR,主打将用户对设计审美的偏好转化为可量化、可训练的数据,成为面向创意和界面生成模型的评测与数据基础设施。文章讨论了其商业模式、竞争格局与未来挑战,包括数据货币化的可持续性和评测体系的抗操控问题。

AI 设计反馈平台 DesignArena 背后的公司 Intelligence 日前宣布完成 790 万美元种子轮融资,领投方为 Index Ventures,参与方包括 Conviction、A* 和 Valkyrie。TechCrunch 在 报道 中写道,Intelligence 还称 DesignArena 已拥有约 530 万用户,并带来约 6000 万美元年经常性收入(ARR)。公司官方 X 账号当天也表示,过去一年里,数百万人通过该平台评估 AI 模型在真实创意任务中的表现。X 帖文

把“好看”变成可量化的偏好数据

DesignArena 的核心思路,不是再做一个单纯的生成工具,而是把用户对设计结果的真实偏好变成可训练、可比较的数据。公司在 About 页面 中称,Design Arena 是一个围绕人类审美和偏好建立的 AI 设计基准,覆盖网站、图片、音频和视频等任务;在 方法论页面 里,平台进一步说明,排行榜来自用户的两两对比投票,并用 Bradley-Terry 模型和 Elo 体系换算成分数,每两小时更新一次。

在公司 2025 年发布的 博客文章 里,团队甚至把“人类品味”直接描述为一种可测量能力,并指出前沿模型在设计任务上仍会出现诸如“白字白底”这类低级错误。换句话说,DesignArena 试图做的,是把“设计好不好用、好不好看、有没有品味”从主观判断,变成可以反复采样的市场数据。

这种从“生成漂亮图片”转向“生成可直接拿去用的视觉成品”的趋势,也出现在 AIFlux 之前对 Qwen-Image-3.0:阿里巴巴把图像生成推向“更像工作工具”的阶段 的报道中。对这类产品来说,模型能不能“跑通”已经不够,关键是最终结果能不能被用户真正选中、真正采用。

为什么投资人愿意为“审美评测”买单

从商业模式看,DesignArena 交易的并不是通用聊天能力,而是围绕创意、网页、图片、视频和应用界面的偏好信号。TechCrunch 引述公司说法称,平台会把不同地区、不同时间的用户偏好变化沉淀下来,再卖给需要优化生成模型的前沿实验室。这意味着,平台价值不只在前端界面,而在后端数据:谁更懂用户,谁就更接近模型训练和产品迭代的关键入口。

这也是为什么“人类反馈”会成为一门独立生意。对模型公司来说,自动化基准可以跑得更大,但并不总能反映真实用户的审美、耐心和最终选择;对 DesignArena 来说,真正稀缺的是那些愿意在真实任务里做判断的用户,以及能够把这些判断转化为稳定商业收入的企业客户。

这条赛道并不空白

DesignArena 进入的是一个正在升温、但竞争已经很清楚的赛道。TechCrunch 在今年 1 月报道,LM Arena 在正式推出付费产品仅四个月后,就完成了 1.5 亿美元 A 轮融资,投后估值达到 17 亿美元;而另一家 crowdsourced 评测平台 Yupp 则在今年 3 月底关闭,成为这类业务并不容易规模化的反例。TechCrunch 在 DesignArena 的报道里也提到,自动化基准容易被操纵,最近的 Hugging Face 安全事件 进一步强化了外界对“只看机器分数”的疑虑。

对 DesignArena 来说,接下来的问题仍然不少:6000 万美元 ARR 的口径是否会在后续披露中被进一步拆分,哪些前沿实验室是其核心客户,估值如何形成,以及“人类品味”究竟能否长期转化为可持续的基础设施生意。眼下可以确认的是,AI 评测已经不再只围绕准确率和速度展开,设计、审美和主观偏好正在成为新的竞争维度。

不错过任何一条 AI 大事

订阅 AIFlux 早报,每天 3 分钟看懂产业动态。

相关阅读