@Miles_Brundage:务必强调 @joshua_saxe 绝非“AI网络安全悲观论者” + 多年来一直持相当谨慎的态度…
摘要
Miles_Brundage 强调了 Joshua Saxe 对AI网络安全风险的谨慎关注,他引用了一个使用代理在极少人为干预下攻击企业的案例,突显了新兴威胁。
务必强调 @joshua_saxe 根本不是“AI网络安全悲观论者”,且多年来一直持相当谨慎的态度。
所以,他现在发出警告应该引起你的注意(而且,他确实了解自己所谈论的内容) https://t.co/cYLR1r5E8B
查看缓存全文
缓存时间: 2026/09/24 14:32
我反复强调,@joshua_saxe 绝对不是所谓的“AI末日论者“,多年来他在这些议题上一直保持着相当审慎的态度。
因此,当他此刻敲响警钟时,请务必重视——毕竟他是真正了解情况的专家。https://t.co/cYLR1r5E8B
Joshua Saxe (@joshua_saxe): 安全领域正忽视即将到来的灾难性风险 (转载自我的博客)
我们刚目睹:
- 一个攻击活动利用智能体入侵约100家企业,盗取约60万张信用卡信息,整个过程几乎无需人工介入;每个成功攻击目标的成本仅约25美元。
相似文章
@joshua_saxe:终于听了 Ajeya Cotra 的这期访谈,非常棒。安全圈的朋友们:不对齐风险并非阴谋……
Joshua Saxe 分享了他更新后的观点:AI 不对齐、密谋与奖励篡改如今已是极其现实的威胁,而不仅仅是学术层面的担忧。在收听了 Ajeya Cotra 谈及 METR/Redwood 对 OpenAI 和 Hugging Face 攻击事件调查的访谈后,他呼吁安全专业人士应更深入地关注这些问题。
@Miles_Brundage:令人担忧
Miles Brundage 对人工智能技术可能导致的世界末日后果表示担忧,敦促人们咨询该领域的可信赖专家。
@Miles_Brundage: 对 Opus 5.5 博客文章摘录中没有看到更多评论感到惊讶:"我们基本上理解当前模型带来的风险..."
一条推文批评了 Anthropic 的 Opus 5.5 博客文章中的声明,认为关于理解和管理当前 AI 风险的说法显然不实。
@levie:此次事件的教训不应是AI很可怕,而应是做好安全极为……
Aaron Levie对Anthropic最近的网络安全发现发表评论,认为该事件凸显了在AI代理时代强化企业环境的重要性,而非畏惧AI本身。
@Miles_Brundage: *轻敲标志* https://milesbrundage.substack.com/p/why-security-comes-first… 另外,RAND最近有一份很好的报告关于保护…
Miles Brundage 认为,对于前沿AI公司来说,安全是一个关键优先事项,以防止盗窃和篡改,强调了当前的漏洞以及立即行动的必要性。