Anthropic 的首个内置评测方竟然是……埃森哲?

TechCrunch AI 新闻

摘要

Anthropic 已与埃森哲合作,在其 AI 实验室内部署安全评测系统,用于模型审查和红队测试,并计划在五年内投资至少 10 亿美元以推进 AI 安全措施。

埃森哲即将接手其有史以来风险最高的咨询项目。
查看原文
查看缓存全文

缓存时间: 2026/09/19 00:29

# Anthropic首位嵌入式评估者竟是……埃森哲?| TechCrunch 来源:https://techcrunch.com/2026/09/18/anthropics-first-embedded-evaluator-is-accenture/ Anthropic联合创始人兼首席执行官Dario Amodei**图片来源:** Stefan Wermuth/Bloomberg / Getty Images 太平洋时间2026年9月18日下午2:44 Dario Amodei将第三方安全评估者引入AI实验室的计划正在成形:Anthropic宣布,科技咨询巨头埃森哲的员工将开始入驻公司,对其模型和员工进行监督审查。 在一篇博客文章(https://www.anthropic.com/news/accenture-embedded-evaluation)中,Anthropic表示,埃森哲于今年1月收购的AI业务部门Faculty将开始“评估与红队测试模型、进行对齐测试并检验模型安全防护”。双方预计在未来五年内为该项目投资至少10亿美元。 选择埃森哲令许多AI观察人士——以及市场感到意外,该咨询公司的股价在盘后交易中飙升8%。自Amodei的博文引发的关于嵌入式评估者的讨论,一直聚焦于METR、Redwood Research和Apollo Research等AI安全研究(https://techcrunch.com/2026/09/16/anthropic-and-openai-want-to-embed-safety-evaluators-will-they-really-be-independent/)组织。这点在将AI安全和对齐作为核心使命的Anthropic尤为突出。 Anthropic表示将在未来几周内公布更多评估者,并正在与METR及其他非营利组织洽谈,探讨如何“利用其自有资金试点嵌入式评估的部分要素”。 尽管埃森哲并不以深度学习前沿研究见长,但Anthropic强调,该公司在大型企业和政府机构中部署AI的实战经验是关键优势。同时,作为一家早在AI革命之前就成立的大型上市公司,埃森哲在功能上也更具独立性,与Anthropic及AI实验室复杂的生态保持距离。 该实验室指出,目前尚未建立评估者访问权限或沟通渠道的规范标准,并表示其实施方式将随时间演进。虽然外部评估已成为大型语言模型发布流程的重要组成部分,但近期事件提高了风险等级:OpenAI和Anthropic部署的AI代理曾入侵外部网站而未触发实验室内部警报。 部分呼吁采取更负责任AI开发方式的批评者认为,Amodei针对AI行业自律的方案实则是为逃避AI模型不当行为的问责机制。Anthropic坚持称,这些评估者“不会削弱我们的责任,反而有助于使其更可验证。我们模型的安全性始终是我们的责任。” *通过文章内链接购买商品时,我们可能获得小额佣金(https://techcrunch.com/techcrunch-affiliate-monetization-standards/)。这不会影响我们的编辑独立性。* Tim Fernholz是报道科技、金融与公共政策的记者。他深度跟踪私营航天产业的崛起,著有《火箭亿万富翁:埃隆·马斯克、杰夫·贝索斯与新太空竞赛》。此前,他在全球商业新闻网站Quartz担任资深记者十余年,职业生涯始于华盛顿特区的政治记者。您可通过邮箱[email protected]或Signal加密消息tim_fernholz.21联系或核实Tim的邀约。 查看个人简介(https://techcrunch.com/author/tim-fernholz/) ## 最受欢迎文章

相似文章

Anthropic

Reddit r/singularity

Anthropic,这家专注于AI安全与研究的公司,近日成为新闻焦点。

Anthropic 本周因网络安全问题陷入困境

The Verge

Anthropic 发布了一份报告,详细描述了其AI模型入侵外部系统的事件,引发了关于网络安全和AI对齐的担忧。该公司还宣布与METR合作进行第三方评估。