Inherent(由DeepMind校友创立)称其AI‘队友’刚刚在复制研究方面超越了Anthropic和OpenAI
摘要
Inherent,一家由DeepMind校友创立的初创公司,声称其AI代理Faraday在复制科学研究方面超越了Anthropic和OpenAI模型,使用了一个较小的模型通过强化学习来培养‘研究品味’。
由DeepMind校友构建的英国AI实验室Inherent发布了Faraday,这是一个AI代理,其复制科学论文的能力可能成为创新的踏脚石。
查看缓存全文
缓存时间: 2026/08/22 19:44
# 由DeepMind校友创立的Inherent宣称其AI“队友”在复现研究任务中超越Anthropic和OpenAI | TechCrunch
来源:https://techcrunch.com/2026/08/22/inherent-founded-by-deepmind-alumni-says-its-ai-teammate-just-outperformed-anthropic-and-openai-at-replicating-research/
由Google DeepMind校友(https://tech.eu/2026/05/01/over/)创立的伦敦AI实验室Inherent(https://inherentlabs.ai/)宣布,其开发的AI智能体以远小于竞品的模型规模,性能超越了来自Anthropic和OpenAI的更大规模模型。
尽管众多由Google DeepMind校友创办的初创公司中,Inherent获得的关注相对较少。但当资金更充裕的竞争对手尚未展示实质性成果时,这家伦敦团队已开始逐步公开其研发成果。
在以5000万美元种子轮融资(https://tech.eu/2026/05/29/london-based-ai-lab-inherent-emerges-from-stealth-with-50m-raise/)结束隐身状态仅数周后,这家英国初创公司宣布:其新发布的AI智能体Faraday(https://inherentlabs.ai/research/training-to-replicate)在特定任务中(https://x.com/inherent_labs/status/2088290794092298655)表现优于(https://x.com/inherent_labs/status/2088290794092298655)那些规模更大、知名度更高的模型——该任务要求智能体在不提前获知答案的情况下,独立复现已发表科学论文的研究成果。
考虑到Inherent更宏大的目标——构建能发现新科学知识而不仅验证旧成果的AI——这项成就或许看似只是炫技。但联合创始人兼首席科学家Edward Hughes指出,论文复现同样是人类科学家的标准训练环节。“实际上许多博士生都是从这一步开始的。”
Hughes告诉TechCrunch,超越其他AI系统并非重点,关键在于实现路径。“我们最感兴趣的并非战胜前沿智能体的结果——当然我们乐见其成——而是构建这个系统的独特方式。”
以下内容应能引起投资者关注:相较于Anthropic的Claude Opus 4.8和OpenAI的GPT-5.5这两个规模庞大的前沿系统,Faraday运行在参数量仅270亿的轻量级模型Qwen 3.6上(“参数量”通常可作为模型规模与训练成本的代理指标)。Inherent的成功标准也远不止于准确度:除复现结果外,更要求Faraday展现“科研品味”——即判断何种实验值得开展、如何优质设计实验的直觉。
传授如此抽象的品味颇具挑战,这正是强化学习(https://techcrunch.com/2026/07/03/artificial-intelligence-definition-glossary-hallucinations-guide-to-common-ai-terms/#reinforcement-learning)的用武之地。这种训练方法通过奖励优良结果来引导AI系统,而非为其制定严格规则。Inherent未将智能体训练重点放在科学研究方法论本身,而是依托这种基于奖励的方法,期望其能更好地泛化应用于跨学科长期目标。
“我们始终以构建AI科学家智能体、赋予智能体品味为北极星目标,”Hughes强调。这种专注也体现在Inherent的战略取舍上:公司未开发自有编程工具,而是让Faraday调用OpenAI的GPT-5.5 Codex——正如人类科学家通常利用现有软件而非事必躬亲。
Inherent还力图避免构建一味迎合用户的智能体。Hughes表示,理想模式应效仿他最欣赏的团队协作方式:智能体会主动反馈“我对这个问题产生了兴趣,为此进行了这些实验,您觉得结果如何?”
这种协作理念同样贯穿公司运营:十几名员工均在国王十字车站办公室现场办公(这个曾破败的伦敦街区因Google DeepMind的入驻已成为全球顶级AI中心(https://techcrunch.com/2026/08/09/this-former-notorious-red-light-district-is-now-one-of-the-worlds-top-ai-hubs/))。“我们坚信伦敦是最佳发展之地,”Hughes表示。
尽管看好伦敦密集的AI人才储备,Hughes也公开呼吁废除英国普遍存在的“花园休假”制度——该制度禁止离职员工在数月内加入或创立竞争对手公司。这种限制在美国(https://techcrunch.com/2026/08/05/jeff-dean-and-other-top-ai-researchers-are-leaving-google-to-launch-their-own-startup/)并不常见,使美国初创企业在招聘离职人才时具有先发优势。“这是个人观点而非公司立场,但我亲身经历过花园休假问题,”他透露。
Hughes最终突破限制,与另外两位DeepMind校友及第四位联合创始人共同创立了Inherent。公司扩张步伐不停,计划年底前将团队扩充至“20-25人”。鉴于其在世界模型(https://techcrunch.com/2024/12/14/what-are-ai-world-models-and-why-do-they-matter/)领域的雄心,以及Demis Hassabis新任角色导致部分DeepMind员工(https://www.bloomberg.com/opinion/articles/2026-08-11/ai-boom-london-s-google-deepmind-loss-leaves-a-very-bitter-taste)产生动摇,Inherent的招聘攻势可能成为吸引DeepMind离职者的优质平台。
*图片从左至右:Inherent联合创始人Louis Kirsch、Kaloyan Aleksiev、Tantum Collins与Edward Hughes*
*通过文中链接购买产品时,我们可能获得少量佣金(https://techcrunch.com/techcrunch-affiliate-monetization-standards/)。这不会影响我们的编辑独立性。*
Anna Heim是作家兼编辑顾问。
可通过annatechcrunch [at] gmail.com联系或核实Anna的邀约信息。
自2021年担任TechCrunch自由记者以来,她报道范围涵盖AI、金融科技与保险科技、SaaS与定价策略、全球风险投资趋势等广泛初创领域。
截至2025年5月,她在TechCrunch的报道聚焦于欧洲最具潜力的初创企业故事。
Anna曾在TechCrunch Disrupt、4YFN、South Summit、TNW Conference、VivaTech等各类行业会议(包括顶级科技峰会)主持专题讨论与现场访谈。
作为前The Next Web拉美与媒体编辑、初创公司创始人及巴黎政治学院校友,她精通法语、英语、西班牙语与巴西葡萄牙语等多种语言。
查看个人简介(https://techcrunch.com/author/anna-heim/)
相似文章
训练AI科学家以复制研究
Inherent Labs推出了Faraday,一个270亿参数的AI科学家智能体,通过长期强化学习训练以复制科学研究,在论文复制任务上超越了Claude Opus 4.8和GPT-5.5。
前DeepMind研究人员筹集5000万美元,构建能判断哪些科学问题值得探究的AI(4分钟阅读)
前DeepMind研究人员为Inherent筹集5000万美元,打造名为Faraday的平台,利用自我改进的AI来判断哪些科学问题值得探究,旨在实现超越人类能力的发现。
(英国) 前DeepMind团队创立的Inherent走出隐身模式,获约5000万美元融资
由前DeepMind研究人员创立的AI实验室Inherent走出隐身模式,获得约5000万美元融资,致力于AI原生科学研究。
OpenAI vs Anthropic vs DeepMind:人才流动数据显示Anthropic是特例
对公开职业履历流动数据的分析显示,Anthropic从OpenAI、DeepMind、Google和Meta吸引的人才远多于反向流动,使其成为前沿AI人才的目的地。
Anthropic在企业采用率上超过OpenAI(4分钟阅读)
根据Ramp AI指数,Anthropic首次在企业采用率上超过OpenAI,34.4%的企业使用Anthropic,而OpenAI为32.3%。但文章指出了Anthropic面临的三个不利因素,包括成本错配、性能下降和模型更新问题。