@caspr_exe: OpenAI联合创始人兼首席科学家Ilya Sutskever:"神经网络越能预测下一个词,就越……
摘要
Ilya Sutskever解释说,神经网络预测下一个词的能力需要真正的理解,而不仅仅是统计模式匹配,并且这类模型会从训练数据中学习人性。
查看缓存全文
缓存时间: 2026/07/20 19:32
Ilya Sutskever, OpenAI联合创始人兼首席科学家:
“一个神经网络越能准确预测下一个词,它就越理解它。”
每个人都称它为自动补全。Ilya解释了为什么这是一个令人安心的谎言。为了猜出谋杀悬疑小说的最后一个词——凶手的名字,模型必须推理书中的每一个线索。如此精准的预测不是统计。而是理解。
然后他说了那句应该让你警醒的话。这些模型训练所用的文本是“世界的一个投影”,为了压缩它,它们越来越多地学习关于人类——“人类境况,他们的希望、梦想和动机。”机器不是在记忆我们的词语。它正在悄然构建一个关于我们的模型。
这就是恐惧的全部前提。机器永远不会恨你。它远比那更理解你。令人恐惧的变量从来不是智能。而是目标。
我写了完整的故事:一个关于AI的恐惧,每个人都理解错了,而另一个已经就在这里。 100%
相似文章
@AnimaAnandkumar:大多数 AI 模型缺少一个关键要素:理解物理世界的能力。获得这种理解的最佳途径…
Anima Anandkumar 重点介绍了一种 Neural Operator 框架,该框架扩展了现有的神经网络架构以学习连续函数,解决了 AI 理解物理世界能力中的一个关键缺口。该工作发表在 Nature 上,并由 Caltech 进行了报道。
面向现实世界的人工智能:与Yann LeCun的对话(12分钟阅读)
Yann LeCun认为,大型语言模型缺乏真正的智能,因为它们不理解物理世界;他主张开发能够学习因果关系并为现实世界应用提供规划的“世界模型”。
关于“它只是一个下一个词预测器”的最佳反驳论点是什么?
这是一个讨论话题,要求提出反对语言模型仅仅是下一个词预测器这一观点的最佳论点,反映了关于人工智能认知的持续辩论。
@LiorOnAI: 大多数世界模型预测接下来会发生什么。Sora预测像素,JEPA压缩观察结果。NEO试图弄清楚…
NEO是一种新型世界模型,它能够从原始观察中自行发现可重用的解释构建块,无需监督或语言,被选为ICML 2026的口头报告。
@VraserX: 我现在最兴奋的AI研究是持续学习。我正在关注的三种方法:1: SEAL Models 生成…
作者分享了对三种持续学习方法的兴奋:SEAL模型(自适应)、测试时学习和终身模型编辑,预测到2027–2028年将实现真正的持续学习,从而形成一个通往人工超级智能的反馈循环。