AI安全审批需要时间表,而非意外关闭
摘要
文章认为,AI模型审批需要明确的时间表和标准,以避免不可预测性,这种不可预测性会给实验室带来不良激励并削弱可靠性,并以最近的Anthropic事件为例。
最近的Anthropic模型事件揭示了AI行业的一个更大问题。如果政府要干预前沿模型的发布,那么这一过程必须明确。并非因为安全性不重要——它显然很重要。而是因为不透明的审批会产生不良激励:实验室过度优化政治因素,用户失去可靠性,盟国面临不确定性,开源生态系统变得更有吸引力,竞争对手从混乱中学习。AI治理最糟糕的版本并非严格的治理,而是不可预测的治理。一个清晰的审批框架应包含时间表、评估标准、申诉路径、披露义务,以及对公共、企业及国际访问的不同门槛。没有这些,模型发布就会变成谣言市场。一个严肃的AI模型审批流程实际上应该是什么样的?
相似文章
AI安全与对齐
文章讨论了对AI安全与对齐的担忧,随着AI变得更智能并融入社会,文章引用了Anthropic呼吁暂停以应对潜在的灾难性风险。
真正的AI风险在实验室内部(5分钟阅读)
作者认为,主要的人工智能风险来自前沿实验室内部的泄露,而不是来自开放权重模型,并呼吁国际安全监督和平衡考虑进展。
@TheAhmadOsman: Anthropic 希望公众看到的只有一件事:那个谨慎的实验室、那个安全实验室、那个试图阻止前沿AI失控的房间里的大人……
本文批评Anthropic利用安全言论为反竞争行为辩护,认为该公司对AI接入的控制威胁了开放性和创新。
Anthropic 首席执行官称现在是时候踩下人工智能的刹车了
Anthropic首席执行官Dario Amodei倡导放缓人工智能开发以优先考虑安全,提出一个涉及外部评估者、行业标准和全球合作的三步计划,引用了诸如递归自我改进和最近网络安全事件等担忧。
Anthropic CEO表示是时候放慢AI模型改进速度了
Anthropic首席执行官呼吁放慢AI模型改进步伐,以强调安全和伦理考量。