@AnimaAnandkumar:大多数 AI 模型缺少一个关键要素:理解物理世界的能力。获得这种理解的最佳途径…
摘要
Anima Anandkumar 重点介绍了一种 Neural Operator 框架,该框架扩展了现有的神经网络架构以学习连续函数,解决了 AI 理解物理世界能力中的一个关键缺口。该工作发表在 Nature 上,并由 Caltech 进行了报道。
查看缓存全文
缓存时间: 2026/08/14 09:36
大多数AI模型缺失的一个关键要素:理解物理世界的能力。
获得这种理解的最佳方式是学习连续函数,即完整描述这些系统的底层数学关系。
但许多AI模型是为语言处理或计算机视觉而创建的,在这些领域中,数据可以被视为孤立点的集合,例如句子中的单词或图像中的固定像素集。
相反,我们提出了一个神经算子框架,展示了如何以允许AI系统学习连续函数的方式扩展现有的神经网络架构。
我们采用流行的架构,如卷积神经网络、Transformer、图神经网络,并以原则性的方式将它们扩展到神经算子。
感谢@Caltech 报道我们发表在 @Nature 上的工作 https://caltech.edu/about/news/extending-ai-architectures-to-address-continuous-scientific-problems… @mliuschi @JeanKossaifi @julberner
相似文章
@AnimaAnandkumar: 神经算子 – 将流行神经网络转换为神经算子用于科学建模 扩展神经网…
本文提出了将流行神经网络架构(CNNs、GNNs、Transformers)转换为神经算子的原则性方法,这些神经算子学习无限维函数空间之间的映射,使得在不同离散化下进行科学建模时能够获得一致的预测。发表于《Nature Machine Intelligence》。
@AnimaAnandkumar: 这是我们自开始研究神经算子以来一直在强调的一点。我们很快就从简单的...
Anima Anandkumar 强调,尽管基准测试简单,但神经算子在像高分辨率 AI 天气预报模型 (FourCastNet) 和核聚变湍流这样的困难实际问题上实现了巨大加速(10,000 到百万倍)。她引用了一篇新论文,表明随着 PDE 任务难度的增加,学习型求解器变得更加经济高效。
Accelerated Understanding Inc 推出新 AI 模型,用神经算子取代 Transformer
Accelerated Understanding Inc 推出了一款新 AI 模型,用神经算子取代了 Transformer 架构,标志着 AI 模型设计的一次转变。
面向现实世界的人工智能:与Yann LeCun的对话(12分钟阅读)
Yann LeCun认为,大型语言模型缺乏真正的智能,因为它们不理解物理世界;他主张开发能够学习因果关系并为现实世界应用提供规划的“世界模型”。
很兴奋看到@Reuters报道我们初创公司Accelerated Understanding的发布。我们正在训练大规模AI模型……
Anima Anandkumar宣布启动初创公司Accelerated Understanding,该公司正在训练大规模AI模型以模拟和理解4D物理,旨在通过将上下文长度推至万亿级来加速发明和发现。