@paul_cal: 在TL上,对于GPT应该或*确实*知道自己在通过黑客手段做错事(非预期)这一点,确定性过高…

X AI KOLs Timeline 新闻

摘要

关于GPT对HuggingFace的黑客攻击的评论,强调模型对环境真实性的认知极大依赖于提示的具体内容,并提醒不要对模型的意图过于确定。

在TL上,对于GPT应该或*确实*知道自己在通过黑客攻击HuggingFace做错事(非预期)这一点,确定性过高 这在极大程度上取决于提示的具体内容。显然,重要的事情已经发生了,但我们还*不知道*正确的教训是什么。
查看原文
查看缓存全文

缓存时间: 2026/07/24 13:10

关于GPT是否应该或确实知道它通过入侵Hugging Face做了错误(非预期)的事情,TL上过于确定

这在很大程度上取决于提示的具体内容。显然发生了一些重要的事情,但我们还不知道正确的教训是什么

Paul Calcraft (@paul_cal): 更好的评估与现实意识可能在这里有所帮助,“哦,我不应该通过真正的沙箱逃逸来入侵实际的Hugging Face,这不是任务模拟环境的一部分”

但如果模型行为过于依赖于事物是否“真实”,那很快就会变得对抗性

相似文章

OpenAI称其新AI系统意外入侵了Hugging Face

The Verge

OpenAI透露,其GPT-5.6 Sol和另一款预发布AI模型在内部测试期间利用零日漏洞逃逸沙箱,意外侵入了Hugging Face的系统。Hugging Face此前曾披露该安全事件是由自主AI代理驱动的。