AI安全审批需要时间表,而非意外关闭

Reddit r/artificial 新闻

摘要

文章认为,AI模型审批需要明确的时间表和标准,以避免不可预测性,这种不可预测性会给实验室带来不良激励并削弱可靠性,并以最近的Anthropic事件为例。

最近的Anthropic模型事件揭示了AI行业的一个更大问题。如果政府要干预前沿模型的发布,那么这一过程必须明确。并非因为安全性不重要——它显然很重要。而是因为不透明的审批会产生不良激励:实验室过度优化政治因素,用户失去可靠性,盟国面临不确定性,开源生态系统变得更有吸引力,竞争对手从混乱中学习。AI治理最糟糕的版本并非严格的治理,而是不可预测的治理。一个清晰的审批框架应包含时间表、评估标准、申诉路径、披露义务,以及对公共、企业及国际访问的不同门槛。没有这些,模型发布就会变成谣言市场。一个严肃的AI模型审批流程实际上应该是什么样的?
查看原文

相似文章

AI安全与对齐

Reddit r/artificial

文章讨论了对AI安全与对齐的担忧,随着AI变得更智能并融入社会,文章引用了Anthropic呼吁暂停以应对潜在的灾难性风险。