@MaxForAI: 前英伟达和Meta研究员,xAI世界模型负责人Ethan He刚刚宣布了离职。 很多人可能不知道他具体负责什么。 他是Grok Imagine(包括视频生成)从0到1阶段的核心成员之一。 他自己说,加入xAI的时候,Grok Imagin…
摘要
Ethan He, former head of world model at xAI and key contributor to Grok Imagine video generation, announced his departure. He built the multimodal video model from scratch in three months after joining xAI in July 2025.
查看缓存全文
缓存时间: 2026/05/21 06:39
前英伟达和Meta研究员,xAI世界模型负责人Ethan He刚刚宣布了离职。
很多人可能不知道他具体负责什么。
他是Grok Imagine(包括视频生成)从0到1阶段的核心成员之一。
他自己说,加入xAI的时候,Grok Imagine还什么都没有:没有数据、没有infra、没有模型。
三个月后,他们发出了多模态视频模型,后面又做了reference-to-video和video extension。
更大一点说,他做的方向一直跟media generation、VLM、world model有关,不是普通视频生成产品经理那种角色。
他在西安交通大学完成了他的本科学业,于 2018 年获得计算机科学与技术学士学位。并在卡内基·梅隆大学(CMU)攻读研究生,于 2018 年进入机器人研究所的计算机视觉理学硕士(MSCV)项目,并于 2019 年 12 月完成学位。
随后Ethan He加入了Meta AI(前身为 Facebook AI Research,FAIR)。 他在 Meta AI 的任期主要集中于多模态学习系统和面向实际应用的模型优化技术。
Ethan He 于 2023 年加入 NVIDIA,担任高级工程师(Staff Engineer),随后担任高级深度学习算法工程师,专注于大规模深度学习训练框架、多模态模型和专家混合(mixture-of-experts)架构。
He 在 NVIDIA 的工作的一方面是参与开发 Cosmos 世界基础模型平台,旨在加速为机器人和自动驾驶等物理人工智能应用创建定制化世界模型。
Ethan He 于 2025 年 7 月加入 xAI,带着他在 NVIDIA 的专业知识为先进 AI 模型的开发做出贡献,特别是在通过 Grok Imagine 项目进行的视频合成领域。
Grok Imagine v0.9 于 2025 年 10 月初发布,改进了视觉质量、运动动态、本地音频生成和生成速度(每个短视频少于 15 秒)。
这让Grok用户数量翻了好几倍(当然也带来了一些争议问题)。
xAI最近确实走了不少人,Ethan这条算是里面比较值得注意的一条。
祝他下一站一切顺利。
Ethan He (@EthanHe_42): I’ve left xAI. It’s been quite a journey. I joined when xAI was about to build Grok Imagine from 0 to 1 - no data, no infra, no model. Three months later, we shipped our multimodal video model, followed by reference-to-video and video extension. I’m grateful for the opportunity
相似文章
@shen_zheng25741: 今天是我在xAI的最后一天。我在xAI的时光紧张而成果丰硕。我有机会参与许多…
沈正宣布离开xAI,他在xAI期间致力于改进Grok的搜索和DeepResearch能力。
@0xLogicrw: 谷歌 AI 核心人物、Gemini 模型技术主管 Noam Shazeer 再次离开谷歌,正式加盟竞争对手 OpenAI。OpenAI 向员工宣布,Shazeer 加盟后将专注于寻找全新的大模型底层架构,并推动 Transformer 架…
Noam Shazeer,Transformer 架构的共同作者和谷歌 Gemini 模型技术主管,再次离开谷歌并正式加盟 OpenAI。他将专注于寻找全新的大模型底层架构并推动 Transformer 演化的研究。
为什么视频代理模型是下一个前沿——Ethan He, xAI Grok Imagine(98分钟阅读)
来自xAI的Ethan He讨论了为什么视频代理模型是下一个前沿,他认为视频模型从LLM中获取智能,并且视频生成的演变将模仿AI编程,从一次性输出转向多轮规划与执行。
@MaxForAI: 据 SemiAnalysis @SemiAnalysis_ 爆料,前Facebook(现Meta)AI架构总监、阿里巴巴技术副总裁、阿里云智能计算平台事业部总裁,现LeptonAI 的创始人兼 CEO 、英伟达系统软件副总裁贾扬清 @ji…
前Facebook AI架构总监、LeptonAI创始人贾扬清在英伟达收购其创业团队一年后离职,据SemiAnalysis爆料,原因包括DGX Lepton运营不及预期及与黄仁勋在开源承诺上的分歧。
@0xLogicrw: OpenAI 旗下视频生成模型 Sora 团队前研究科学家、自学成才的瑞典青年加布里埃尔·彼得森 (Gabriel Petersson) 宣布从 OpenAI 离职。彼得森表示,他离开 OpenAI 是为了独立创业,计划在通用人工智能 (…
OpenAI Sora团队前研究科学家Gabriel Petersson宣布离职,计划在通用人工智能到来前独立创业打造最后一款产品。