标签
旨在防止恶意使用的AI安全护栏,同时也阻碍了合法的进攻性网络安全研究人员,他们需要不受限制的模型访问权限来识别和利用漏洞以进行防御。研究人员批评了像Anthropic和OpenAI这样的AI公司所实施的任意把关行为。
Hugging Face使用中国开源模型GLM 5.2抵御了一次完全自主的AI网络攻击,此前美国前沿模型的安全护栏阻止了防御行动,重新引发关于AI安全与竞争力的争论。
David Sacks 认为,美国的AI监管措施削弱了美国模型的竞争力,他指出中国的Kimi K3修复了15个安全漏洞,而Codex和Fable拒绝解决。
一家公司描述了过度严格的AI护栏如何使其支持机器人无法处理基本查询,凸显了安全性与功能性之间不可持续的权衡。