token-sizes

标签

Cards List
#token-sizes

100万亿+的预训练数据???这是我见过模型训练中最大的数据量。

Reddit r/LocalLLaMA · 2026-06-01

一个新的人工智能模型正在使用超过100万亿个令牌进行训练,是其他模型如Kimi、Mimo和DeepSeek通常使用的27-50万亿令牌预训练数据规模的两倍。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈