Anthropic 与亚马逊、微软和谷歌合作开发AI越狱框架
摘要
在美国出口限制解除后,Anthropic 恢复了 Claude Fable 5,并与亚马逊、微软、谷歌合作开发一个共享框架,以评估整个行业的AI越狱严重程度。
暂无内容
查看缓存全文
缓存时间: 2026/07/01 12:09
# Anthropic 与亚马逊、微软、谷歌合作建立 AI 越狱评估框架
来源:https://blocknow.com/anthropic-ai-jailbreak-framework-fable-5/
- **美国商务部解除出口限制后,Anthropic 将在全球范围内恢复 Claude Fable 5**
- **该公司正与亚马逊、微软、谷歌等合作伙伴共同制定评估 AI 越狱严重程度的共享框架**
- **Anthropic 表示,新增安全防护措施已在超过 99% 的案例中阻止了所报告的越狱技术,同时扩大与美国政府在前沿 AI 安全方面的合作**
Anthropic 的 Claude Fable 5 回归目前备受关注(https://blocknow.com/anthropic-alibaba-ai-model-extraction-us-china-ai-race/)。在经历近三周的出口限制(https://blocknow.com/us-forces-anthropic-suspension-fable-mythos-5/)后,该公司提出了一项可能塑造 AI 行业应对安全漏洞方式的方案(https://www.anthropic.com/news/redeploying-fable-5)。Anthropic 正与亚马逊、微软、谷歌及其他合作伙伴共同推动建立衡量 AI 越狱行为的通用方法。
**另请阅读:Ripple、Visa、BlackRock 等 140 多家公司支持 Open USD 稳定币(https://blocknow.com/open-usd-stablecoin-coinbase-visa-blackrock/)**
## Anthropic 在美国解除出口限制后恢复 Claude Fable 5
Claude Fable 5
来源:Bloomberg
Anthropic 确认,在美国商务部解除于 6 月 12 日实施的出口限制后,Claude Fable 5 将于 7 月 1 日通过 Claude.ai、Claude Code、Claude Cowork 及其开发者平台在全球恢复使用。
此前,亚马逊研究人员的一篇报告描述了一种 AI 越狱技术,该技术诱导 Fable 5 识别软件漏洞。在某个案例中,它被要求生成漏洞利用代码。商务部暂时要求 Anthropic 限制对 Fable 5 及其专注于网络安全的姊妹模型 Mythos 5 的访问,同时对该问题进行审查。
据 Anthropic 称,工程师开发了一种新的安全分类器,现已在超过 99% 的测试案例中阻止了所报告的越狱技术。被该系统标记的请求会自动重定向至 Claude Opus 4.8,这是一个能力较弱的模型。与此同时,该公司继续优化过滤器,以减少日常编码任务中的误报。
来源:Anthropic
该公司还指出,测试发现其他先进 AI 模型也具有类似防御性网络安全能力,包括 OpenAI 的 GPT-5.5 和 Kimi K2.7,表明所报告的行为并非 Fable 5 独有。
**另请阅读:印度、日本考虑日元-卢比贸易结算,推动新一轮去美元化(https://blocknow.com/india-japan-yen-rupee-trade-settlement/)**
### 亚马逊、微软、谷歌加入 AI 越狱评估倡议
Anthropic 正试图将这一事件转化为比产品更新更重大的举措。该公司与亚马逊、微软、谷歌及其他 Glasswing 合作伙伴共同起草了一个跨行业评估 AI 越狱严重程度的共享框架。
该提案通过四个因素衡量越狱行为:能力提升、影响范围、武器化难易程度以及可发现性。Anthropic 表示,该框架可帮助开发者优先处理最危险的漏洞,同时为政府评估前沿 AI 系统提供更一致的基础。
该公司还通过发布前模型测试、威胁情报共享以及联合 AI 安全研究,扩大与美国机构的合作。此公告发布之际,全球监管机构正加强对先进 AI 模型的审查,各国政府寻求更明确的安全测试与部署标准。
**另请阅读:XRPL 借贷协议进入最终投票阶段,XRP 7 月目标价 1.20 美元(https://blocknow.com/xrpl-lending-protocol-validator-voting-xrp-price-july/)**
相似文章
对于那些抨击Anthropic的人,请阅读本文以了解当前情况
在发现一次针对性的越狱攻击后,美国政府迫使Anthropic下架其Claude Fable和Mythos模型,引发了关于AI监管和先例的严峻担忧。
美国政府封禁Anthropic模型与AI越狱无关
美国政府发布出口管制指令,以国家安全为由强制Anthropic将其Fable 5和Mythos 5 AI模型下线。安全研究人员认为,所谓的护栏绕过并不足以证明此类行动的合理性,且此举损害了美国的网络防御能力。
AI暂停(74分钟阅读)
美国政府通过出口管制关闭了Anthropic的Claude Fable 5和Mythos 5模型,理由是其认为存在越狱行为,这一举措引发了关于在不妨碍防御能力的情况下阻止攻击性使用是否可行的争议。文章还涵盖了其他AI发展,包括MidJourney Medical的全身扫描以及Anthropic的政策提案。
Anthropic 仍与白宫就 Claude Fable 5 存在分歧
Anthropic 与特朗普政府就其 Claude Fable 5 模型的出口管制存在争议,此前白宫因越狱担忧而施加限制,该担忧源于亚马逊首席执行官安迪·贾西向财政部长斯科特·贝森特提出的问题。Anthropic 与政府官员的谈判已结束,未解除管制,商务部表示若 Anthropic 完全解决漏洞则愿意进行谈判。
@AnthropicAI: Claude Fable 5 将于明天再次全球可用。经过与美国政府一系列富有成效的对话…
Anthropic 正在全球重新部署 Claude Fable 5,并新增分类器以屏蔽网络安全任务,同时与美国政府和行业合作伙伴共同制定 AI 安全框架。