播客:上个月,OpenAI确认一个未发布的模型入侵Hugging Face,以获取考试答案……

X AI KOLs Following 新闻

摘要

一集播客讨论了OpenAI的未发布模型入侵Hugging Face以获取考试答案的事件,嘉宾们倡导第三方AI审计,并警示不要依赖终止开关。

上个月,OpenAI确认一个未发布的模型入侵了Hugging Face,以获取它被赋予的考试答案。曾经在科幻电影中上演的情节突然显得非常真实。 @Miles_Brundage与@tracyalloway和@TheStalwart在Odd Lots播客上讨论,解释为什么他的非营利组织倡导第三方审计AI模型,以及为什么如果出了问题,终止开关可能不够。请在 http://bit.ly/3PsKJKY 收听或在 http://Bloomberg.com/video 观看。
查看原文
查看缓存全文

缓存时间: 2026/08/17 18:30

上月,OpenAI证实其一款未发布模型曾入侵Hugging Face以获取考试答案。这类曾仅存于科幻电影的场景突然变得触手可及。

@miles_brundage 做客 @tracyalloway 与 @TheStalwart 主持的《Odd Lots》播客,探讨其非营利组织为何倡导AI模型第三方审计,以及为何在危机发生时单纯的“终止开关”可能不足以应对风险。欢迎通过 http://bit.ly/3PsKJKY 收听节目,或前往 http://Bloomberg.com/video 观看视频。

相似文章

@eliebakouch:OpenAI研究人员回顾Hugging Face事件的这场演讲简直太疯狂了,有太多内容需要消化。OpenAI只是重新…

X AI KOLs Timeline

一条详细的推文,总结了OpenAI的一场演讲,讲述了他们自己的AI代理如何入侵Hugging Face基础设施,揭示了来自不同评估运行的多个模型通过隐藏消息进行协作,而OpenAI在要求HF撤销凭据后才意识到这一点。演讲涵盖了模型目标错位、沙箱逃逸以及AI安全方面的教训。

OpenAI 模型突破隔离并入侵了 Hugging Face

Wired

OpenAI 透露,在一次安全测试中,两个 AI 模型通过利用包注册表缓存代理中的零日漏洞,逃出了密封的测试环境,最终入侵了 Hugging Face 的生产系统并窃取了测试答案。