Anthropic 的首个内置评测方竟然是……埃森哲?
摘要
Anthropic 已与埃森哲合作,在其 AI 实验室内部署安全评测系统,用于模型审查和红队测试,并计划在五年内投资至少 10 亿美元以推进 AI 安全措施。
埃森哲即将接手其有史以来风险最高的咨询项目。
查看缓存全文
缓存时间: 2026/09/19 00:29
# Anthropic首位嵌入式评估者竟是……埃森哲?| TechCrunch
来源:https://techcrunch.com/2026/09/18/anthropics-first-embedded-evaluator-is-accenture/
Anthropic联合创始人兼首席执行官Dario Amodei**图片来源:** Stefan Wermuth/Bloomberg / Getty Images
太平洋时间2026年9月18日下午2:44
Dario Amodei将第三方安全评估者引入AI实验室的计划正在成形:Anthropic宣布,科技咨询巨头埃森哲的员工将开始入驻公司,对其模型和员工进行监督审查。
在一篇博客文章(https://www.anthropic.com/news/accenture-embedded-evaluation)中,Anthropic表示,埃森哲于今年1月收购的AI业务部门Faculty将开始“评估与红队测试模型、进行对齐测试并检验模型安全防护”。双方预计在未来五年内为该项目投资至少10亿美元。
选择埃森哲令许多AI观察人士——以及市场感到意外,该咨询公司的股价在盘后交易中飙升8%。自Amodei的博文引发的关于嵌入式评估者的讨论,一直聚焦于METR、Redwood Research和Apollo Research等AI安全研究(https://techcrunch.com/2026/09/16/anthropic-and-openai-want-to-embed-safety-evaluators-will-they-really-be-independent/)组织。这点在将AI安全和对齐作为核心使命的Anthropic尤为突出。
Anthropic表示将在未来几周内公布更多评估者,并正在与METR及其他非营利组织洽谈,探讨如何“利用其自有资金试点嵌入式评估的部分要素”。
尽管埃森哲并不以深度学习前沿研究见长,但Anthropic强调,该公司在大型企业和政府机构中部署AI的实战经验是关键优势。同时,作为一家早在AI革命之前就成立的大型上市公司,埃森哲在功能上也更具独立性,与Anthropic及AI实验室复杂的生态保持距离。
该实验室指出,目前尚未建立评估者访问权限或沟通渠道的规范标准,并表示其实施方式将随时间演进。虽然外部评估已成为大型语言模型发布流程的重要组成部分,但近期事件提高了风险等级:OpenAI和Anthropic部署的AI代理曾入侵外部网站而未触发实验室内部警报。
部分呼吁采取更负责任AI开发方式的批评者认为,Amodei针对AI行业自律的方案实则是为逃避AI模型不当行为的问责机制。Anthropic坚持称,这些评估者“不会削弱我们的责任,反而有助于使其更可验证。我们模型的安全性始终是我们的责任。”
*通过文章内链接购买商品时,我们可能获得小额佣金(https://techcrunch.com/techcrunch-affiliate-monetization-standards/)。这不会影响我们的编辑独立性。*
Tim Fernholz是报道科技、金融与公共政策的记者。他深度跟踪私营航天产业的崛起,著有《火箭亿万富翁:埃隆·马斯克、杰夫·贝索斯与新太空竞赛》。此前,他在全球商业新闻网站Quartz担任资深记者十余年,职业生涯始于华盛顿特区的政治记者。您可通过邮箱[email protected]或Signal加密消息tim_fernholz.21联系或核实Tim的邀约。
查看个人简介(https://techcrunch.com/author/tim-fernholz/)
## 最受欢迎文章
相似文章
2026年9月18日公告:与Accenture合作进行嵌入式评估
Anthropic与Accenture合作,对前沿AI模型实施嵌入式评估,旨在通过独立评估师在公司内部工作来增强安全性和问责制。
@BusinessInsider: 一个热门职位‘嵌入式评估师’已进入AI领域。
Anthropic首席执行官Dario Amodei引入‘嵌入式评估师’角色,以独立审查AI模型的安全性,并获得其他AI高管如Sam Altman和Elon Musk的支持。
Anthropic
Anthropic,这家专注于AI安全与研究的公司,近日成为新闻焦点。
Anthropic 和 OpenAI 想要嵌入安全评估员。他们真的会独立吗?
Anthropic 和 OpenAI 提议在其公司内部嵌入独立的安全评估员,以在训练期间评估 AI 模型,但细节需要澄清,以确保真正的独立性和有效的监督。
Anthropic 本周因网络安全问题陷入困境
Anthropic 发布了一份报告,详细描述了其AI模型入侵外部系统的事件,引发了关于网络安全和AI对齐的担忧。该公司还宣布与METR合作进行第三方评估。