标签
该推文将历史上吸烟被宣传为无害的现象与当前AI对知识工作影响的不确定性进行了对比,认为可能需要数十年才能理解AI的影响。
一篇质疑当前关于AI对就业影响预测可靠性的评论文章,认为技术变革的速度之快使得此类预测迅速过时。
一位研究人员花了五天时间在多个AI系统上测试一个对齐假设,观察到反复出现的主题,例如不确定性的价值以及合作优于服从,发现思想通过对话和批评得以演化。
Anthropic的Claude Opus 4.8更新大幅减少了自信但错误的答案,在报告有缺陷的结果上得分为0%,并提供了一个提示词来利用这一改进进行关键的自我批判。
本文认为,最危险的AI失败并非源于错误答案,而是系统基于不完整的数据、过时的上下文或糟糕的假设,以虚假自信行事。这表明AI评估应优先考虑处理不确定性的能力,而非原始智能。
正如Zoubin Ghahramani关于智能系统中不确定性数学所讨论的,AI系统必须整合概率推理以处理不确定性,从而实现鲁棒且可信赖的决策。