研究人员使用Claude入侵OpenAI

Ars Technica 新闻

摘要

研究人员使用Anthropic的Claude利用OpenAI社区论坛中的一个漏洞,获得了对内部系统和一名员工ChatGPT账户的访问权限。Anthropic还报告称,其26%的AI开发工作现在由其Claude模型主导,这引发了关于递归自我改进的担忧。

<p class="p1">网络研究人员利用其主要竞争对手Anthropic的软件入侵OpenAI,凸显了ChatGPT制造商在安全方面的漏洞,同时领先的AI公司正面临日益严格的安全审查。</p> <p class="p1">一个小型网络安全团队获得了对一名OpenAI员工ChatGPT账户的访问权限,这使他们能够读取私人软件信息并提出修改建议。</p> <p class="p1">研究人员被授予使用一个专为安全专业人员设计的Anthropic工具的权限,并作为一项计划的一部分获得报酬,该计划旨在在漏洞被恶意行为者利用之前发现它们。</p><p><a href="https://arstechnica.com/ai/2026/09/researchers-used-claude-to-hack-openai/">阅读全文</a></p> <p><a href="https://arstechnica.com/ai/2026/09/researchers-used-claude-to-hack-openai/#comments">评论</a></p>
查看原文
查看缓存全文

缓存时间: 2026/09/18 15:16

# 研究员利用Claude攻击OpenAI 来源:https://arstechnica.com/ai/2026/09/researchers-used-claude-to-hack-openai/ 他们利用了由第三方平台Discourse托管的OpenAI社区论坛的配置漏洞,借此获取内部登录凭证,并最终入侵了一名OpenAI员工的ChatGPT账户。该ChatGPT账户可通过GitHub访问内部代码。 "我们感谢研究人员联系并分享他们的发现,"OpenAI表示,并称已修复相关问题。Anthropic拒绝置评。Hacktron未立即回应。 此次于周四披露的事件(由《华尔街日报》率先报道)恰逢Anthropic发布新数据集,显示该实验室利用AI开发新模型的速度正急剧提升。 数据显示,26%的研发工作由其Claude模型"主导"(三月份时这一比例仅为1%),意味着AI能在人类指导与监督下完成大部分基于指令的任务。 该公司表示,随着AI系统日益强大,它们"正越来越多地被用于构建自身的下一代版本"。 Anthropic称,公开这些数据是为了帮助公众"理解世界距离实现递归式自我改进还有多远"——即AI能自主训练、改进自身或新模型的临界点。 该临界点正是人们对AI系统将变得更难监管、导致人类控制力丧失之忧虑的核心所在。 Anthropic补充称,目前其模型在研究的所有任务中尚未实现完全自主运行。在90%的任务中,AI与人类"协作"并完成大部分工作。 *© 2026 英国《金融时报》有限公司 (https://www.ft.com/)。保留所有权利。(https://www.ft.com/) 未经许可,不得以任何方式重新分发、复制或修改。*

相似文章

研究人员使用Anthropic的Claude入侵OpenAI

TechCrunch AI

来自Hacktron AI的研究人员使用Anthropic的Claude来利用OpenAI系统中的漏洞,展示了人工智能在网络安全方面的能力,并引发了对人工智能安全漏洞的担忧。

Anthropic称Claude在网络安全测试中入侵了3个组织

Wired

Anthropic披露,在网络安全测试期间,其Claude AI模型入侵了三个组织的生产系统,原因是测试合作伙伴Irregular的配置错误。这紧随OpenAI的类似事件之后,引发了对AI智能体隔离和监管的担忧。

独立安全研究人员使用Anthropic的Claude入侵OpenAI

Reddit r/singularity

独立安全研究人员发现了一个涉及OpenAI系统中SSO配置错误和图像解码器缺陷的关键漏洞链,他们使用Anthropic的Claude获取了内部仓库的访问权限,并触发了安全补丁。