@threeaus: 我强烈推荐大家观看Jev创始人Diogo Almeida的这次演讲,他早就预测了一切……
摘要
本文推荐Jev创始人Diogo Almeida的一次演讲,批评了ChatGPT和Claude Code等AI模型中RLHF的使用,并倡导超越人类偏好优化的真正自动化。
查看缓存全文
缓存时间: 2026/09/21 23:39
强烈建议大家观看 Jev 创始人 Diogo Almeida 的这场演讲,他早已预言了关于 Jev 的一切。
Jev 从一开始就是为自动化而生的。Diogo Almeida 认为,当前的大语言模型走上了一条堪称史诗级的弯路——那就是 RLHF(基于人类反馈的强化学习)。
RLHF 在人机交互(即取悦人类)方面表现出色,但在自动化方面却糟糕透顶。它无法实现完全自动化;人类必须始终参与其中。
不仅是 ChatGPT,Claude Code 的原罪也在于 RLHF。因此他认为,ChatGPT 和 Claude Code 本质上属于同一范式——Claude Code 并非下一个时代;真正的自动化才是未来。
简而言之,RLHF 是关于收集人类偏好并基于此进行优化。它的优化目标也不是自动化。
他还否定了 RLVR 是答案的观点:RLHF 优化人类偏好,RLVR 优化纯粹的正确性,而他们正在探索的第三条路径优化的是校准后的决策能力。
Diogo Almeida 相信数据比算力更重要,而做对任务远比拥有数据更重要。预训练模型本身已经足够聪明;问题只在于我们用偏好优化扭曲了它们。
附:视频翻译使用了 @dotey 的宝剪制作,这基本就是我梦想中的翻译软件——超好用。
原始视频链接:
相似文章
@3three_AI: 与其刷抖音整夜,不如观看Jev创始人(前OpenAI研究员)的最新演讲…
Jev创始人,一位前OpenAI研究员,在演讲中将Jev定位为大语言模型的下一阶段,声称与当前方法如RLHF相比,它快200倍、便宜400倍,且无幻觉。
@alacheng:TypeSafe AI创始人Diogo Almeida在Jev发布前的演讲中,本应在OpenAI意识到对齐……
TypeSafe AI创始人Diogo Almeida讨论了当前AI模型的局限性,并介绍了Jev,一个使用RLCD对齐的新模型,专为软件自动化而非人机交互设计。
在共同发明ChatGPT后,我不断自问:为什么超人聊天模型没有导向AGI?我过去两年里一直在……
ChatGPT的共同发明者宣布发布名为Jev的新AI模型,采用RLCD训练,声称其速度快20-200倍,成本低40-400倍(输出代币免费),并针对可组合智能进行了优化,作为通往AGI的路径。
如果您在候补名单上,请回复您想尝试什么,或许我会帮助您 …
Diogo Almeida,ChatGPT的联合发明者,宣布发布一个新的AI模型Jev,该模型使用RLCD训练,并承诺显著的速度提升。
一位ChatGPT发明者推出的新型AI模型令开发者兴奋不已
一款名为Jev的新型AI模型,由TypeSafe AI的ChatGPT发明者开发,输出概率而非文本,为软件自动化任务提供快速、廉价且无幻觉的替代方案。