AI评分 一般 (59)AI 中文改写

设计竞技场创作者融资790万美元,为AI模型增添品味

1 天前 8 阅读来源:techcrunch.com

AI 中文改写

原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接

设计竞技场(Design Arena)背后的公司Intelligence近日宣布完成790万美元种子轮融资,由Index Ventures领投,Conviction、A*、Valkyrie等机构参投。这家由几位大学好友在2025年毕业前几周创立的公司,如今已吸引全球530万用户,其核心业务是为AI模型提供规模化的人类审美反馈——简单说,就是让AI生成的内容变得更“有品味”。 故事的起点颇具戏剧性。联合创始人Grace Li回忆,团队最初只是想做一个AI游戏引擎,模型确实能生成可玩的游戏,但无一例外都“不好玩”。这引出一个关键问题:如何判断一个游戏是否有趣?他们意识到,机器无法替代人类的直觉判断,于是开始思考如何大规模获取真实的人类反馈。这个想法迅速演变为Design Arena——一个让用户对AI生成内容进行“A/B对决”排序的平台。用户输入提示词,选择网站、图片等格式和风格后,系统会展示多组生成结果,用户只需从最佳到最差逐一排序。对普通用户而言,这像是一个高级模型路由器;但对AI企业来说,这简直是一座取之不尽的“人类偏好金矿”。 “这成了许多模型在设计领域改进的缺失瓶颈,”Li表示,“大约一周后,我们就与一家前沿实验室签下了第一笔大单,之后的故事就顺理成章了。”目前,Design Arena的年经常性收入(ARR)已达6000万美元,付费客户包括多家顶级AI实验室。平台的真正价值在于企业端——参与模型可以将其视为源源不断的即时反馈源,而用户对具体使用哪个模型并不在意,他们只想要最好的输出结果,因此排序数据能精准反映真实用户需求。更关键的是,用户必须登录才能获取生成结果,这使得Intelligence能够追踪不同大洲、不同时间段内审美偏好的变化趋势(Li指出,亚洲的网页设计风格往往更偏向“极繁主义”)。 这种人类主导的评估数据,恰好弥补了自动化基准测试的短板。后者虽然规模更大,但容易被“刷分”或操纵——上周Hugging Face遭入侵的事件就生动展示了这一点。不过,众包人类反馈并非稳赚不赔的生意。今年早些时候,同样主打人类评估的初创公司Yupp在获得a16z crypto的Chris Dixon投资的3300万美元后,运营不到一年便关停,尽管它也曾拿下前沿模型客户并宣称拥有130万用户,却始终未能建立可持续的商业模式。但另一家采取类似思路评估文本响应的LM Arena却蒸蒸日上,在正式推出付费产品仅四个月后,便于今年1月完成了1.5亿美元的A轮融资。可见,这个赛道虽充满变数,但谁能为AI提供最真实的人类品味数据,谁就可能成为下一个赢家。

以上为 AI 中文改写版本,如需查看英文原文请访问

英文原文 · techcrunch.com

内容版权归原作者及 techcrunch.com 所有

这篇文章对你有帮助吗?
觉得有用?分享给更多人

留言 · 0

暂无留言,来说两句吧

留言经合规过滤后展示,禁止违法内容