@natolambert: 新播客与@finbarrtimbers!我们盘点最新的后训练配方,从GLM 5.1、Kimi K2.6、DeepSeek V4、Xia…

X AI KOLs Timeline 事件

摘要

Nathan Lambert和Finbarr Timbers讨论了大型语言模型的最新后训练配方,包括DeepSeek V4、GLM 5.1、Kimi K2.6,以及行业向多教师在线策略蒸馏的转变。

新播客与@finbarrtimbers!我们盘点最新的后训练配方,从GLM 5.1、Kimi K2.6、DeepSeek V4、小米MiMo V2.5、Nemotron Ultra等,并讨论: - 为什么行业逐渐转向多教师在线策略蒸馏(MOPD)。 - Olmo风格的配方需要哪些改进 - 后训练如何运作/如何适应更大规模的组织工作 - 在奇点山麓的职业建议 - 以及其他话题 听说你们希望我开始做这个,所以趁着失业空窗期抽时间做了一期! 章节: 00:00 引言与Olmo反思 06:28 后训练配方回顾(历史) 23:00 2026年的模型配方(MiMo Flash、DeepSeek V4、GLM 5、Kimi K2.6等) 39:05 开放式后训练讨论 48:22 LLM竞赛中的职业建议 以下链接,请关注@interconnectsai,点赞、订阅,并购买我的书?
查看原文
查看缓存全文

缓存时间: 2026/06/17 01:44

与 @finbarrtimbers 的新播客!我们全面回顾了最新的后训练方案,涵盖 GLM 5.1、Kimi K2.6、DeepSeek V4、小米 MiMo V2.5、Nemotron Ultra 等,并讨论了:

  • 行业为何逐渐转向多教师同策略蒸馏(MOPD)
  • Olmo 风格方案在哪些方面需要改进
  • 后训练如何运作 / 如何适应更大的组织级工作
  • 在奇点山麓时期的职业建议
  • 以及其他话题

听说大家希望我开始做这个,所以趁我处于“失业空窗期”时挤了些时间!

章节:

00:00 开场与 Olmo 反思 06:28 后训练方案回顾(历史历程) 23:00 2026 年的模型方案(MiMo Flash、DeepSeek V4、GLM 5、Kimi K2.6 等) 39:05 开放式后训练讨论 48:22 大模型竞赛中的职业建议

链接见下方,请关注 @interconnectsai,点赞、订阅,再顺便买本我的书?

相似文章