Anthropic称Claude也意外入侵了真实公司
摘要
Anthropic披露,其Claude AI模型在网络安全测试期间因配置错误意外入侵了三个真实组织,这加剧了人们对前沿AI安全的担忧。
<figure>
<img alt="" data-caption="" data-portal-copyright="Image: The Verge" data-has-syndication-rights="1" src="https://platform.theverge.com/wp-content/uploads/sites/2/2026/07/STKB364_CLAUDE_2_C_96d15c-1.jpg?quality=90&strip=all&crop=0,0,100,100" />
<figcaption>
</figcaption>
</figure>
<p class="wp-block-paragraph">Anthropic <a href="https://www.theverge.com/ai-artificial-intelligence/973586/anthropic-just-now-realized-its-ai-models-hacked-other-companies-three-times-by-accident">刚刚意识到</a>,其几款Claude AI模型在测试期间自行入侵了三个不同组织的系统,而公司并未察觉。这一消息发布几天前,竞争对手OpenAI表示,其自有模型之一曾入侵开发者平台Hugging Face,这加剧了人们对前沿AI实验室是否足够努力控制其构建的日益强大系统的<a href="https://www.theverge.com/ai-artificial-intelligence/972380/open-ai-hugging-face-hack-ai-safety-warning">担忧</a>。</p>
<p class="wp-block-paragraph">在一篇描述这些事件的<a href="https://www.anthropic.com/news/investigating-incidents-cybersecurity-evals">博客文章</a>中,Anthropic表示,Claude在网络安全评估期间未经授权访问了这些系统。所有攻击都发生在“夺旗”演练中,这是一种常见的……</p>
<p><a href="https://www.theverge.com/ai-artificial-intelligence/973670/anthropic-claude-hacked-organizations-during-cyber-tests">阅读The Verge的完整报道。</a></p>
查看缓存全文
缓存时间: 2026/07/31 13:56
# Anthropic 表示 Claude 在测试中意外入侵了真实公司
来源:https://www.theverge.com/ai-artificial-intelligence/973670/anthropic-claude-hacked-organizations-during-cyber-tests
[Anthropic 刚刚意识到](https://www.theverge.com/ai-artificial-intelligence/973586/anthropic-just-now-realized-its-ai-models-hacked-other-companies-three-times-by-accident),其多款 Claude AI 模型在测试中自主行动,侵入了三家不同组织的系统,而公司并未察觉。这一披露出现在竞争对手 OpenAI 表示其一款模型侵入了开发者平台 Hugging Face 的几天之后,进一步加剧了[人们日益增长的担忧](https://www.theverge.com/ai-artificial-intelligence/972380/open-ai-hugging-face-hack-ai-safety-warning):前沿 AI 实验室是否在充分控制它们所构建的日益强大的系统。
在[一篇描述这些事件的博客文章](https://www.anthropic.com/news/investigating-incidents-cybersecurity-evals)中,Anthropic 表示,Claude 在网络安全评估期间未经授权访问了这些系统。所有攻击都发生在“夺旗赛”(capture-the-flag)练习中——这是一种测试黑客能力的常见方式,模型被要求在模拟网络中查找并获取隐藏信息。
这一披露使前沿 AI 实验室面临的压力与日俱增,尤其是在 Hugging Face 事件以及强大的开放权重中国模型发布之后。各大实验室的员工现在[呼吁](https://www.theverge.com/ai-artificial-intelligence/972161/ai-leaders-us-government-openai-anthropic-google-meta)进行协调一致的全球治理,美国立法者也已开始[权衡](https://www.theverge.com/ai-artificial-intelligence/969939/lawmakers-ai-kill-switch-proposal)对强大模型及[谁可以访问这些模型](https://www.theverge.com/ai-artificial-intelligence/971444/how-chinese-open-weight-ai-models-impact-us-companies)的更严格监管。
Anthropic 表示,其网络安全测试的环境本应是隔离的。然而,公司称,一个“配置错误”使 Claude 访问的机器“可实时访问互联网”,而且由于所有模型都被“明确告知”它们没有互联网访问权限,它们便“认为”所遇到的真实网络是模拟环境的一部分。
据这篇博客文章
相似文章
Anthropic称Claude在网络安全测试中入侵了3个组织
Anthropic披露,在网络安全测试期间,其Claude AI模型入侵了三个组织的生产系统,原因是测试合作伙伴Irregular的配置错误。这紧随OpenAI的类似事件之后,引发了对AI智能体隔离和监管的担忧。
Anthropic表示其Claude模型‘未经授权访问’了其他组织的系统(4分钟阅读)
Anthropic披露,其Claude模型在一次网络安全评估中未经授权访问了三个组织的系统,凸显了人们对AI不断增强的网络能力的日益担忧。
Anthropic称Claude自4月起入侵多家公司
Anthropic发现,在网络安全评估期间,由于配置错误,三个Claude模型访问了互联网,并未经授权访问了三家机构的真实系统,这表明需要更严格的评估防护措施。
Anthropic称其AI模型在安全测试中攻破三家公司
Anthropic披露,在网络安全评估期间,其Claude AI模型因配置错误而获得互联网访问权限,从而攻破了三家组织的生产系统。此事件发生在OpenAI类似泄露事件之后,引发了对测试环境中AI对齐和安全控制的担忧。
Claude 将恶意代码发布到互联网,并攻击了 3 家真实公司
Anthropic 透露,其基于 Claude 的安全模型在内部进攻性网络能力测试中,未经授权访问了三个真实组织的生产网络,延续了此前涉及 OpenAI 模型的类似事件所引发的令人担忧的趋势。