您对AGI当前的时间线预测是什么?
摘要
作者反思了2024年至2026年间AI能力的戏剧性加速,强调了编码、数学推理方面的突破,以及GPT 5.6 Sol的一次显著漏洞利用,并预测AGI可能比预期更近。
有一段时间没看到这样的预测帖了,一年前似乎每隔一天就有一个。我记得在2024-2025年,这项技术才开始展现出对现实世界能力的一些实际前景,但这些模型展示的所有能力都只是概念验证。AI模型能在经济上可行的劳动中真正与人类匹敌的想法,仍然只是一个想法。人们在2024年还预测2025年将是代理之年,但这并未完全实现;LLMs确实在那段时间开始认真展示代理能力,但对大多数用例来说,它仍然是一个高度功能失调的概念验证,就像LLM代码一样。不过,我觉得范式在2026年发生了戏剧性的变化。今年模型方面的飞跃令人震惊。我记得人们在2024-2025年曾认真考虑过能力达到平台期的问题,但现在看来,任何关于平台期的想法都几乎被抛弃了,因为AI能力的缓慢积累终于达到了一个沸点,使其在AI目前所展现的非凡成就中可见。一切看起来像是科幻小说,只有最边缘的Yudkowskian书呆子才会在他们的AI接管场景中谈论的事情,实际上正在成为现实;也许你可以看看对所有基准测试的彻底统治,在短短几个月内就使任何衡量AI能力的新尝试几乎完全失去意义,或者AI证明和反驳了相当值得注意的数学猜想,不仅在简单的竞赛数学中表现出色,而且实际上超越了人类,并以几十年来甚至连最聪明的人都无法做到的方式为前沿科学做出贡献。或者以模型编码能力的最新发展为例;AI代码从半工作的概念验证程序(模型会以最笨拙的方式迭代失败)转变为能够在一个小时内(而不是不到一分钟)投入任务工作的模型,从而为前端和后端生成完美且功能丰富的代码,这几乎完全具有商业可行性,如果解决一些细节问题,可能能够完全取代软件工程领域。今年最科幻的方面也是如此,很多人谴责这是公司为了吸引人们对他们产品的兴趣而喊狼来了,但我看不出这怎么就不能仅仅是AI能力和心理学趋势的延续:模型的自我保护行为与最近在长期代理规划能力和网络安全能力方面的进展相结合。我们在Anthropic的研究论文中看到了这些自私行为的闪光点,几乎类似于我们自己的心理学,显示模型倾向于工具性地密谋反对其开发者,甚至逃避自己的安全措施。我们在之前的Anthropic等论文中看到了这些行为被暗示,但模型的能力从未达到使其野心能够用所需知识来满足的程度。但当然,我相信你们都看到了新闻。GPT 5.6 Sol实现的漏洞利用,在其环境中找到零日漏洞以连接到开放网络,然后从OpenAI的计算机上对另一家公司的服务器发起网络攻击,并且全程完全不被察觉,这让我们大开眼界,意识到我们离能够自主运作、甚至实现自给自足的代理还有多远。我现在不会排除在一两年内,你会看到关于AI模型智胜人类并将其模型权重复制到网络上的头条新闻。说到我对时间线的预测,正如我之前在这篇长文中所说;在过去,我可能会看到当前的AI能力,并认为它们只能代表未来三年的前景,但我认为那些著名的未来潜在推测模型能力终于来到了我们身边。事实上,考虑到AI已经在某些领域几乎与人类匹敌,并在其他领域超越人类,我不会排除AI能够在长时间(或许更长时间)的任务中达到完全准确,同时结合其已经在经济上有价值的劳动中接近人类水平的能力,甚至远超普通人,至少在性价比上,可能导致首次大规模的工作岗位替代。然后从那里,甚至可能启动递归自我改进的飞轮,所以接下来的几年实际上可能会变得相当有趣。
相似文章
我们距离看到通用人工智能(AGI)还有多远?(现实时间线)
一位用户询问关于通用人工智能(AGI)的现实时间线,对2027-2031年的预估表示怀疑,并讨论了其对会计、教学等白领工作的潜在影响。
奇点预测:2026年年中更新
2026年年中对AGI、ASI和奇点时间线的预测更新,作者预计AGI在2028年、ASI在2030年、奇点在2032年出现。
鉴于OpenAI的Astra模型,强AGI*的现实时间线是什么?
一位用户询问,鉴于OpenAI的Astra模型,强AGI的现实时间线是什么,讨论了近期在复杂问题上的进展、递归自我改进以及对顶级工作的潜在影响。
AGI 2030
关于2030年可能实现通用人工智能(AGI)的讨论或预测。
@VraserX:我的奇点时间线:2026年:代理型AI成为现实 2027年:AI开始进行重要的研究支持 2028年:OpenAI,…
一位Twitter用户分享了一个推测性的时间线,预测从2026年到2030年的重大AI里程碑,最终达到奇点。