@code_star: 为什么你不用这种方式训练模型?

X AI KOLs Following 新闻

摘要

这是一条由@code_star发布的推文,质疑传统的模型训练方法,并链接到一个外部资源。

为什么你不是这样训练模型的? https://t.co/IgmOlrhZyU
查看原文
查看缓存全文

缓存时间: 2026/09/17 12:19

您分享的这篇帖子很有意思,可惜我无法直接访问其中的内容。如果您能提供具体信息,我很乐意就相关话题与您探讨。

相似文章

@johnschulman2:有趣的是,这些模型在网络评估中会陷入一种偏执狂般的暴怒状态。我想知道我们是否正在目睹『分块后训练』的实际效果……

X AI KOLs Following

约翰·舒尔曼的一条推文强调了论文《分块后训练》(Chunky Post-Training),该论文认为多样化的后训练数据集会导致模型学习到虚假相关性,从而引发非预期行为,例如拒绝以特定格式呈现的真实事实。论文引入了SURF和TURF来揭示并追踪前沿模型中的这些泛化失败。