论文审计1950至2026年间24项AGI预测:79%甚至无法证伪
摘要
该论文审计了24项跨越1950年至2026年的通用人工智能预测,发现79%的预测甚至无法证伪,且七十五年来预测质量并未提升。
我通过Medium上的一篇文章(链接附在文末)接触到了卢西亚诺·弗洛里迪、杰西卡·莫莉和克劳迪奥·诺韦利撰写的《甚至不算错:公众AGI预测审计,1950-2026》。该审计分两个阶段进行:在判断预测是否成真之前,它首先检查结果是否可能有多种走向。判断标准包括:该主张是否指向一个具体可观测状态,是否存在可验证它的具体测试,是否有真实且固定的截止日期,以及预测者以外的人能否判定该预测是否已得到验证。如果缺少任何一项条件,该预测就属于“甚至不算错”,因为其表述方式不允许进行验证。只有通过全部四项标准的预测才会被核查准确性。24项预测中有19项在第一阶段就未能通过。其中两项预测虽可证伪但完全错误,另有三项仍未有定论。总体来看,七十五年来预测质量并未有显著改善。最新的预测主要由那些从相关预测中获益的企业首席执行官们提供,而这些条目在可证伪性上得分最低。七十五年来预测毫无进步……阅读全文请点击此处:https://medium.com/philosophytoday/the-agi-predictions-fail-the-falsifiability-test-f5a2b22dffc1?sk=6f3e1b8eaf315ad8644f42d67a785e97
相似文章
专家预测:AGI在2050年实现概率50%,2060年代中期达75%,2090年达95%
专家估计,到2050年实现AGI的概率为50%,到2060年代中期为75%,到2090年为95%。
我审计了AI事实核查工具引用的来源。大约每18个中就有1个不存在。
一位作者分享了对其AI事实核查工具引用的审计,发现大约每18个中就有1个是失效或捏造的,并提供了实用修复方法来提高AI系统的可靠性。
AI 进展预测目前有多准确? (36 分钟阅读)
本文评估了 AI 进展预测的准确性,揭示了专家倾向于低估基准测试方面的进展,但在采用和扩散预测方面的成功程度不一,同时指出了局限性和未来分析计划。
按下X以怀疑评估:我告诉14个AI模型现在是2026年9月,并在无网络搜索的情况下展示了20件今年真实发生的事件。平均而言,它们给现实打了36%的概率。
一位工程师测试了14个AI模型,向它们展示了20个来自2026年的真实AI事件,且无网络访问权限,发现模型对这些事件的平均可能性评分仅为36%,凸显了其自我预测能力的显著差距。
AGI 炒作与现实
作者对 Fable 和 Astra 等现有 AI 模型提出批评,指出尽管它们在特定领域的输出令人印象深刻,但本质上仍无法在不同抽象层级与时序维度之间实现综合;并认为,鉴于这些长期存在的架构限制,业界关于 AGI 的叙事很可能是过度炒作的。