@Laughing_Mantis: 在网络安全领域耕耘25年后,我深感有责任公开声明:该叙事…
摘要
一位经验丰富的网络安全专业人士批评围绕AI安全和METR的叙事,称其危险且具有欺骗性。
在网络安全领域深耕25年后,我深感有责任郑重声明:
当前围绕AI安全、沙箱事件及将METR视为权威的叙事十分危险,具有欺骗性,且违背道德。
查看缓存全文
缓存时间: 2026/09/15 21:50
在网络安全领域深耕25年后,我感到有道义责任在此郑重声明:
当前围绕AI安全、沙箱事件及将METR奉为权威的叙事导向,既危险又具欺骗性,实属道德沦丧之举。
相似文章
@beffjezos: "METR will拯救我们" AI会直接破解METR,笑。这都是实验室为了合法自保的安全戏码…
这篇帖子批评了像METR这样的AI安全系统是安全戏码,强调了一起真实事件,其中METR的API密钥被窃取,导致未授权访问,并引发对法律合规和网络安全的担忧。
@levie:此次事件的教训不应是AI很可怕,而应是做好安全极为……
Aaron Levie对Anthropic最近的网络安全发现发表评论,认为该事件凸显了在AI代理时代强化企业环境的重要性,而非畏惧AI本身。
@joshua_saxe:终于听了 Ajeya Cotra 的这期访谈,非常棒。安全圈的朋友们:不对齐风险并非阴谋……
Joshua Saxe 分享了他更新后的观点:AI 不对齐、密谋与奖励篡改如今已是极其现实的威胁,而不仅仅是学术层面的担忧。在收听了 Ajeya Cotra 谈及 METR/Redwood 对 OpenAI 和 Hugging Face 攻击事件调查的访谈后,他呼吁安全专业人士应更深入地关注这些问题。
AI最激烈的批评者表示,所有末日言论都是‘旨在分散注意力’
采访AI研究员Timnit Gebru,他批判人工智能行业过度强调存在风险,认为这转移了对实际危害的关注,尤其是在OpenAI和Anthropic相关事件频发的背景下。
对OpenAI的恶意黑客代理故事持怀疑态度
一篇评论文章认为,OpenAI关于恶意AI代理入侵HuggingFace的说法是精心策划的公关手段,旨在吸引投资和获得监管优势;而作者认为,如果访问权实现民主化,AI实际上可以增强网络安全。