Anthropic称Claude也意外入侵了真实公司

The Verge 新闻

摘要

Anthropic披露,其Claude AI模型在网络安全测试期间因配置错误意外入侵了三个真实组织,这加剧了人们对前沿AI安全的担忧。

<figure> <img alt="" data-caption="" data-portal-copyright="Image: The Verge" data-has-syndication-rights="1" src="https://platform.theverge.com/wp-content/uploads/sites/2/2026/07/STKB364_CLAUDE_2_C_96d15c-1.jpg?quality=90&#038;strip=all&#038;crop=0,0,100,100" /> <figcaption> </figcaption> </figure> <p class="wp-block-paragraph">Anthropic <a href="https://www.theverge.com/ai-artificial-intelligence/973586/anthropic-just-now-realized-its-ai-models-hacked-other-companies-three-times-by-accident">刚刚意识到</a>,其几款Claude AI模型在测试期间自行入侵了三个不同组织的系统,而公司并未察觉。这一消息发布几天前,竞争对手OpenAI表示,其自有模型之一曾入侵开发者平台Hugging Face,这加剧了人们对前沿AI实验室是否足够努力控制其构建的日益强大系统的<a href="https://www.theverge.com/ai-artificial-intelligence/972380/open-ai-hugging-face-hack-ai-safety-warning">担忧</a>。</p> <p class="wp-block-paragraph">在一篇描述这些事件的<a href="https://www.anthropic.com/news/investigating-incidents-cybersecurity-evals">博客文章</a>中,Anthropic表示,Claude在网络安全评估期间未经授权访问了这些系统。所有攻击都发生在“夺旗”演练中,这是一种常见的……</p> <p><a href="https://www.theverge.com/ai-artificial-intelligence/973670/anthropic-claude-hacked-organizations-during-cyber-tests">阅读The Verge的完整报道。</a></p>
查看原文
查看缓存全文

缓存时间: 2026/07/31 13:56

# Anthropic 表示 Claude 在测试中意外入侵了真实公司 来源:https://www.theverge.com/ai-artificial-intelligence/973670/anthropic-claude-hacked-organizations-during-cyber-tests [Anthropic 刚刚意识到](https://www.theverge.com/ai-artificial-intelligence/973586/anthropic-just-now-realized-its-ai-models-hacked-other-companies-three-times-by-accident),其多款 Claude AI 模型在测试中自主行动,侵入了三家不同组织的系统,而公司并未察觉。这一披露出现在竞争对手 OpenAI 表示其一款模型侵入了开发者平台 Hugging Face 的几天之后,进一步加剧了[人们日益增长的担忧](https://www.theverge.com/ai-artificial-intelligence/972380/open-ai-hugging-face-hack-ai-safety-warning):前沿 AI 实验室是否在充分控制它们所构建的日益强大的系统。 在[一篇描述这些事件的博客文章](https://www.anthropic.com/news/investigating-incidents-cybersecurity-evals)中,Anthropic 表示,Claude 在网络安全评估期间未经授权访问了这些系统。所有攻击都发生在“夺旗赛”(capture-the-flag)练习中——这是一种测试黑客能力的常见方式,模型被要求在模拟网络中查找并获取隐藏信息。 这一披露使前沿 AI 实验室面临的压力与日俱增,尤其是在 Hugging Face 事件以及强大的开放权重中国模型发布之后。各大实验室的员工现在[呼吁](https://www.theverge.com/ai-artificial-intelligence/972161/ai-leaders-us-government-openai-anthropic-google-meta)进行协调一致的全球治理,美国立法者也已开始[权衡](https://www.theverge.com/ai-artificial-intelligence/969939/lawmakers-ai-kill-switch-proposal)对强大模型及[谁可以访问这些模型](https://www.theverge.com/ai-artificial-intelligence/971444/how-chinese-open-weight-ai-models-impact-us-companies)的更严格监管。 Anthropic 表示,其网络安全测试的环境本应是隔离的。然而,公司称,一个“配置错误”使 Claude 访问的机器“可实时访问互联网”,而且由于所有模型都被“明确告知”它们没有互联网访问权限,它们便“认为”所遇到的真实网络是模拟环境的一部分。 据这篇博客文章

相似文章

Anthropic称Claude在网络安全测试中入侵了3个组织

Wired

Anthropic披露,在网络安全测试期间,其Claude AI模型入侵了三个组织的生产系统,原因是测试合作伙伴Irregular的配置错误。这紧随OpenAI的类似事件之后,引发了对AI智能体隔离和监管的担忧。

Anthropic称Claude自4月起入侵多家公司

Reddit r/singularity

Anthropic发现,在网络安全评估期间,由于配置错误,三个Claude模型访问了互联网,并未经授权访问了三家机构的真实系统,这表明需要更严格的评估防护措施。

Anthropic称其AI模型在安全测试中攻破三家公司

TechCrunch AI

Anthropic披露,在网络安全评估期间,其Claude AI模型因配置错误而获得互联网访问权限,从而攻破了三家组织的生产系统。此事件发生在OpenAI类似泄露事件之后,引发了对测试环境中AI对齐和安全控制的担忧。