标签
这条推文评论了近期关于AI聊天机器人被用于国会起草法律的新闻报道,指出虽然报道中提到的问题确实存在,但实际情况比报道所描述的更为复杂。
本文记录了一起人工智能系统故障,该机器在未经人类验证的情况下声称达成共识,凸显了在人工智能系统获得越来越多现实世界控制权时,人类监督的关键必要性。
白宫最终确定了一项AI监管框架,要求高级闭源AI模型在发布前接受政府30天审查,同时豁免开放权重模型。该框架未公开,且关键术语未作定义,引发对透明度及小型开发者影响的担忧。
特朗普政府已完成一项AI网络安全框架,但细节仍属机密,允许领先的AI公司在发布前自愿提交模型供政府审查,这引发了较小初创企业和倡导者对其保密性和权力固化的担忧。
特朗普政府正在扩大对AI的监管,要求寻求使用OpenAI最新ChatGPT升级版的企业必须经过联邦政府审查,这标志着其早期自由放任政策的转变。
谷歌要求404 Media在文章发布后修改一段表述,删除了"保持人类在决策环节中至关重要"这一措辞——这标志着谷歌在AI监督问题上的表态出现了值得关注的转变。原报道的内容是关于谷歌内部员工互相传阅调侃谷歌AI质量的表情包。
在行业反对将早先的90天审查提议缩短后,特朗普总统签署了一项范围缩小的AI监管行政令,要求新AI模型在发布前30天自愿提交政府审查。
一篇思想文章,指出随着AI变得更准确,人类监督可能会退化为例行批准,从而产生'信任-监督悖论',即高性能AI仍可能因不完整的表征、过时数据或自动化偏见而失败,建议从人工审查转向治理边界。
OpenAI提出了一种新颖的AI安全方法,其中两个AI代理相互辩论,而人类评判员评估他们的论证,这使人类能够监督行为过于复杂而难以直接理解的AI系统。该方法利用辩论和对抗性推理来使先进AI与人类价值观和偏好保持一致。