标签
讨论了一篇安全论文,该论文展示了顶级模型(Opus、Sol)的加密推理可以被替换到较弱模型(Haiku)中,从而绕过安全护栏,原因是模型和会话之间共享一个全局加密密钥。这引发了关于OpenAI、Anthropic和Google为何独立地收敛到相同脆弱设计的问题。