@kyutai_labs: 我们训练60亿参数模型,基于Common Crawl数据按时间顺序从2018年到2025年排序,使得最新数据最后被模型看到…

X AI KOLs Following 论文

摘要

Kyutai Labs 训练60亿参数模型,使用按时间顺序从2018年到2025年排列的Common Crawl数据,表明近期年份上的性能下降消失,并开源检查点以供持续学习研究。

我们训练60亿参数模型,基于Common Crawl数据按时间顺序从2018年到2025年排序,使得最新数据最后被模型看到,并展示了在更近年份上的性能下降消失。 我们开源这些检查点,用于未来持续学习的研究。https://t.co/8fFwpUesIz
查看原文
查看缓存全文

缓存时间: 2026/05/27 07:03

我们训练了6B参数模型,使用按2018至2025年时间顺序排列的Common Crawl数据,确保最新数据最后被模型看到,并表明模型在较新年份上的性能下降已消失。

我们开放了这些检查点的源代码,以供未来在持续学习领域的研究使用。https://t.co/8fFwpUesIz

相似文章