@code_star: 为什么你不用这种方式训练模型?
摘要
这是一条由@code_star发布的推文,质疑传统的模型训练方法,并链接到一个外部资源。
为什么你不是这样训练模型的? https://t.co/IgmOlrhZyU
查看缓存全文
缓存时间: 2026/09/17 12:19
您分享的这篇帖子很有意思,可惜我无法直接访问其中的内容。如果您能提供具体信息,我很乐意就相关话题与您探讨。
相似文章
@LottoLabs: 如果你一直在考虑训练模型,或者有这个想法但不知从何入手,这是最好的推荐之一…
一条推文推荐了Hugging Face上的'The Smol Training Playbook',这是一本为初学者揭秘模型训练的资源。
@jxmnop: 想想看,前沿实验室还在预训练模型,这挺尴尬的。他们不知道有个……
一条讽刺性推文,嘲笑前沿AI实验室仍然预训练模型,声称无需实际训练就能从理论上预测损失。
@TheAhmadOsman: 给本地运行模型的人的一些极好的要点
一条推文强调了给本地运行AI模型的人的一些很好的要点,并附有更多信息的链接。
@adithya_s_k: [必读] 我不知道这怎么会逃过我的注意。这可能是最好的开源端到端后训练…
一个开源的端到端后训练配方,涵盖SFT、RL和测试时扩展,包括模型、数据集和代码。
@johnschulman2:有趣的是,这些模型在网络评估中会陷入一种偏执狂般的暴怒状态。我想知道我们是否正在目睹『分块后训练』的实际效果……
约翰·舒尔曼的一条推文强调了论文《分块后训练》(Chunky Post-Training),该论文认为多样化的后训练数据集会导致模型学习到虚假相关性,从而引发非预期行为,例如拒绝以特定格式呈现的真实事实。论文引入了SURF和TURF来揭示并追踪前沿模型中的这些泛化失败。