@gmkurtzer:我刚听了来自@arcee_ai首席技术官@latkins的这个视频,他谈到了训练大型MO…
摘要
Gregory Kurtzer称赞Lucas Atkins的演讲,内容涉及训练大型稀疏混合专家模型的经验教训,以及AI实验室初创公司的生活。
查看缓存全文
缓存时间: 2026/08/07 12:55
我刚听了来自@arcee_ai CTO @latkins的这个视频,讲的是训练大型MoE稀疏模型的经验教训,以及在AI初创实验室里的生活。
这是一场信息量极大且精彩绝伦的演讲,Lucas和他的团队所取得的成就无论怎么称赞都不为过。
也非常感谢你们如此坦诚地向全世界分享你们的经验。太棒了!
Lucas Atkins (@latkins): 我想他们会发的,如果发了我们一定会转发。这基本上是我在AIcouncil演讲的一个较短视频版本:https://t.co/IZtedBqwke
抱歉胡子有点邋遢。
相似文章
@awnihannun: @angeloskath 关于使用MLX构建本地自主AI的视频非常出色。我还听说这是观看次数最多的视频之一……
一条推文强调了Angelos Kath在WWDC上关于使用MLX构建本地自主AI的出色视频,指出开源权重模型和硬件能力的快速进展。
@arcane_bloom: https://x.com/arcane_bloom/status/2077733957995733062
讨论了一期 Latent Space 播客,其中 Anjney Midha 解释为何拥有无限 GPU 的 AI 实验室仍会失败,并结合他在 amppublic 和 a16z 的经历进行了阐述。
@swyx: 完整文章和链接在此
Latent Space 播客的一集讨论了这样一个论点:视频模型从大语言模型(LLM)中获取智能,下一个前沿是视频智能体。嘉宾 Ethan He(曾在 xAI 构建 Grok Imagine)分享了构建前沿图像和视频系统的见解。
@phosphenq:Andrej Karpathy 这段 2 小时视频,比今年你刷过的所有 AI 教程加起来还管用
OpenAI 联合创始人 Andrej Karpathy 发布了一段 2 小时教学视频,承诺让观众大幅提升大语言模型的实战能力。
@danintheory:精彩的对话,也是学习重要开放AI问题的有趣方式!
红杉资本强调当前一次性训练的AI模型与人类持续学习之间的差距,并指出了EngramLab在具有内部记忆、永不停止学习的AI方面的工作。