DesignArena 创造者筹集 790 万美元,为 AI 模型带来审美
摘要
AI 评估工具 DesignArena 背后的公司 Intelligence 完成了 790 万美元的种子轮融资,由 Index Ventures 领投。该平台利用人类偏好排名来改进 AI 生成的媒体内容,目前拥有 530 万用户和 6000 万美元的年度经常性收入(ARR)。
DesignArena 在全球拥有 530 万用户,为前沿实验室提供关键的人类评估。
查看缓存全文
缓存时间: 2026/08/03 19:33
# DesignArena 创始人筹集 790 万美元,为 AI 模型赋予审美能力 | TechCrunch
来源:https://techcrunch.com/2026/08/03/designarena-creators-raise-7-9-million-to-bring-taste-to-ai-models/
正如联合创始人 Grace Li 所言,她的公司始于 2025 年毕业前几周,当时一群大学好友正尝试让他们的 AI 游戏引擎跑起来。这些模型能够制作出功能完整的游戏,但没有任何一款是真正好玩的——这引发了一个有趣的问题:你如何判断一款游戏会不会有趣?
他们认定,人类判断无可替代,很快便开始集思广益,探索如何大规模获取真实的人类反馈。
最终成果便是 DesignArena(https://www.designarena.ai/)——一个如今在全球拥有 530 万用户的 AI 工具。事实证明,许多 AI 公司都在寻找可扩展的用户反馈渠道,而且其中不少愿意为此付费。
“对于许多希望在设计领域取得进步的模型来说,这正是缺失的瓶颈,”Li 表示。“大约一周后,我们就与一家前沿实验室达成了首笔重大交易,之后的事情便顺理成章。”
周一,DesignArena 背后的公司——Intelligence(https://www.intelligence.ai/)——宣布完成 790 万美元的种子轮融资,由 Index Ventures 领投,Conviction(Sarah Guo 和 Mike Vernal)、A*、Valkyrie 等参投。
对于非企业用户而言,使用 DesignArena 很像使用一个精密的模型路由器。它有一个类似 ChatGPT 的提示词窗口,并提供针对网站、图片以及其他十余种视觉格式的独立下拉菜单。输入请求、格式和风格后,你会看到一系列“A vs. B”选项,直到你将几个输出从最佳到最差排序完毕。
这是一个有用的服务,但该平台的真正价值在于企业端——参与其中的模型可将其视为媒体生成模型的无穷尽即时反馈来源。用户往往并不在意自己评价的是哪个模型——正如 Li 所说,他们只想获得最好的输出——因此,他们的排名可以为“用户真正想要什么”提供关键输入。
Li 表示,对于前沿实验室而言,这是一项值得付费的服务。她补充说,该网站目前年经常性收入(ARR)达 6000 万美元,巩固了其作为 AI 行业人类主导评估数据关键来源的地位。
至关重要的是,用户必须登录才能获得输出结果,因此 Intelligence 还能追踪不同大洲、不同时间下这些审美的变化。(Li 指出,亚洲的网页仪表盘往往呈现更极繁主义的设计风格。)这些措施是对自动化基准的重要补充——自动化基准虽能更大规模运行,但常常会被钻空子或以其他方式操纵,正如上周 Hugging Face 入侵事件(https://techcrunch.com/2026/07/30/in-the-hugging-face-breach-openais-hacker-was-noisy-and-fast-but-not-unstoppable/)所戏剧性地展示的那样。
这并不是说众包人类反馈就一定会成为一个稳赢的市场。Yupp 在推出不到一年后,于今年早些时候关闭,此前它从 a16z crypto 的 Chris Dixon 处筹集了 3300 万美元。它也争取到了一些前沿模型作为客户,并声称拥有超过 130 万用户,但最终仍未能建立起可持续的长期业务。
即便如此,其他基于人类评估的初创公司似乎正在蓬勃发展。LM Arena 对基于文本的回答采取了类似方法,在正式推出付费产品仅四个月后,于 1 月完成了 1.5 亿美元的 A 轮融资(https://techcrunch.com/2026/01/06/lmarena-lands-1-7b-valuation-four-months-after-launching-its-product/)。
*当您通过我们文章中的链接购买商品时,我们可能会获得少量佣金(https://techcrunch.com/techcrunch-affiliate-monetization-standards/)。这不会影响我们的编辑独立性。*
Russell Brandom 自 2012 年以来一直报道科技行业,重点关注平台政策和新兴技术。他曾任职于 The Verge 和 Rest of World,并为 Wired、The Awl 和 MIT Technology Review 撰稿。可通过 [email protected] 或 Signal 412-401-5489 与他联系。
查看简介(https://techcrunch.com/author/russell-brandom/)
相似文章
@grx_xce:今天,我们推出 @Intelligence_ai。在6个月内,作为10人团队,我们将 ARR 从500万美元增长到6000万美元,并拥有550万用户……
Intelligence_ai 推出 DesignArena,这是一个通过真实用户请求评估 AI 模型的通用界面,获得了由 Index Ventures 领投的 790 万美元种子轮融资。该团队在六个月内将 ARR 从 500 万美元增长到 6000 万美元。
Arena,人人都在用的AI排行榜,如今已成为价值1亿美元的业务
Arena,这个源自加州大学伯克利分校的AI模型排行榜平台,在推出商业服务八个月后,年化经常性收入已达到1亿美元,凸显了市场对AI模型评估服务日益增长的需求。
Fish Audio 获得5200万美元种子轮融资,面向创作者和企业构建AI语音模型
Fish Audio 已获得5200万美元种子轮融资,用于面向创作者和企业开发AI语音模型。这家初创公司年经常性收入(ARR)达2100万美元,拥有800万用户,提供开源和付费语音生成模型,包括其最新的S2.1 Pro API。
Prime Intellect 完成1.3亿美元A轮融资,助力企业构建自有AI代理
Prime Intellect 以10亿美元估值完成1.3亿美元A轮融资,为企业提供构建自有AI代理的全栈平台,以市场形式提供算力访问、强化学习工具和评估能力。
@ryaneshea: 今天我发布了 AI IQ —— 前沿 AI 模型,按照人类智商量表进行评分。摒弃无尽的排行榜表格,AI IQ 展示了:• 模型在智商正态分布曲线上的位置 • 前沿智商随时间的变化 • 模型在智商和情商方面的对比 • 实践中获取智能的成本。包括 GPT-5.5、Claude Opus 4.7、Gemini 3.1、Grok 4.3、Kimi K2.6、Qwen 3.6、DeepSeek V4、Muse Spark 等。链接在首评中。好奇哪张图表最让你惊讶。
作者推出了“AI IQ”,这是一款新工具,按人类智商量表对前沿 AI 模型进行评分,提供模型性能、智能成本以及情商对比的可视化图表,而非传统的排行榜表格。