DesignArena 创造者筹集 790 万美元,为 AI 模型带来审美

TechCrunch AI 新闻

摘要

AI 评估工具 DesignArena 背后的公司 Intelligence 完成了 790 万美元的种子轮融资,由 Index Ventures 领投。该平台利用人类偏好排名来改进 AI 生成的媒体内容,目前拥有 530 万用户和 6000 万美元的年度经常性收入(ARR)。

DesignArena 在全球拥有 530 万用户,为前沿实验室提供关键的人类评估。
查看原文
查看缓存全文

缓存时间: 2026/08/03 19:33

# DesignArena 创始人筹集 790 万美元,为 AI 模型赋予审美能力 | TechCrunch 来源:https://techcrunch.com/2026/08/03/designarena-creators-raise-7-9-million-to-bring-taste-to-ai-models/ 正如联合创始人 Grace Li 所言,她的公司始于 2025 年毕业前几周,当时一群大学好友正尝试让他们的 AI 游戏引擎跑起来。这些模型能够制作出功能完整的游戏,但没有任何一款是真正好玩的——这引发了一个有趣的问题:你如何判断一款游戏会不会有趣? 他们认定,人类判断无可替代,很快便开始集思广益,探索如何大规模获取真实的人类反馈。 最终成果便是 DesignArena(https://www.designarena.ai/)——一个如今在全球拥有 530 万用户的 AI 工具。事实证明,许多 AI 公司都在寻找可扩展的用户反馈渠道,而且其中不少愿意为此付费。 “对于许多希望在设计领域取得进步的模型来说,这正是缺失的瓶颈,”Li 表示。“大约一周后,我们就与一家前沿实验室达成了首笔重大交易,之后的事情便顺理成章。” 周一,DesignArena 背后的公司——Intelligence(https://www.intelligence.ai/)——宣布完成 790 万美元的种子轮融资,由 Index Ventures 领投,Conviction(Sarah Guo 和 Mike Vernal)、A*、Valkyrie 等参投。 对于非企业用户而言,使用 DesignArena 很像使用一个精密的模型路由器。它有一个类似 ChatGPT 的提示词窗口,并提供针对网站、图片以及其他十余种视觉格式的独立下拉菜单。输入请求、格式和风格后,你会看到一系列“A vs. B”选项,直到你将几个输出从最佳到最差排序完毕。 这是一个有用的服务,但该平台的真正价值在于企业端——参与其中的模型可将其视为媒体生成模型的无穷尽即时反馈来源。用户往往并不在意自己评价的是哪个模型——正如 Li 所说,他们只想获得最好的输出——因此,他们的排名可以为“用户真正想要什么”提供关键输入。 Li 表示,对于前沿实验室而言,这是一项值得付费的服务。她补充说,该网站目前年经常性收入(ARR)达 6000 万美元,巩固了其作为 AI 行业人类主导评估数据关键来源的地位。 至关重要的是,用户必须登录才能获得输出结果,因此 Intelligence 还能追踪不同大洲、不同时间下这些审美的变化。(Li 指出,亚洲的网页仪表盘往往呈现更极繁主义的设计风格。)这些措施是对自动化基准的重要补充——自动化基准虽能更大规模运行,但常常会被钻空子或以其他方式操纵,正如上周 Hugging Face 入侵事件(https://techcrunch.com/2026/07/30/in-the-hugging-face-breach-openais-hacker-was-noisy-and-fast-but-not-unstoppable/)所戏剧性地展示的那样。 这并不是说众包人类反馈就一定会成为一个稳赢的市场。Yupp 在推出不到一年后,于今年早些时候关闭,此前它从 a16z crypto 的 Chris Dixon 处筹集了 3300 万美元。它也争取到了一些前沿模型作为客户,并声称拥有超过 130 万用户,但最终仍未能建立起可持续的长期业务。 即便如此,其他基于人类评估的初创公司似乎正在蓬勃发展。LM Arena 对基于文本的回答采取了类似方法,在正式推出付费产品仅四个月后,于 1 月完成了 1.5 亿美元的 A 轮融资(https://techcrunch.com/2026/01/06/lmarena-lands-1-7b-valuation-four-months-after-launching-its-product/)。 *当您通过我们文章中的链接购买商品时,我们可能会获得少量佣金(https://techcrunch.com/techcrunch-affiliate-monetization-standards/)。这不会影响我们的编辑独立性。* Russell Brandom 自 2012 年以来一直报道科技行业,重点关注平台政策和新兴技术。他曾任职于 The Verge 和 Rest of World,并为 Wired、The Awl 和 MIT Technology Review 撰稿。可通过 [email protected] 或 Signal 412-401-5489 与他联系。 查看简介(https://techcrunch.com/author/russell-brandom/)

相似文章

@ryaneshea: 今天我发布了 AI IQ —— 前沿 AI 模型,按照人类智商量表进行评分。摒弃无尽的排行榜表格,AI IQ 展示了:• 模型在智商正态分布曲线上的位置 • 前沿智商随时间的变化 • 模型在智商和情商方面的对比 • 实践中获取智能的成本。包括 GPT-5.5、Claude Opus 4.7、Gemini 3.1、Grok 4.3、Kimi K2.6、Qwen 3.6、DeepSeek V4、Muse Spark 等。链接在首评中。好奇哪张图表最让你惊讶。

X AI KOLs Following

作者推出了“AI IQ”,这是一款新工具,按人类智商量表对前沿 AI 模型进行评分,提供模型性能、智能成本以及情商对比的可视化图表,而非传统的排行榜表格。