标签
来自哈佛大学和UIUC的研究人员发现了第三个预训练轴,将样本效率提高了6.2倍,并将GenAI生成速度提高了250倍。
在 V100 GPU 上,使用 Qwen3.6 27B 模型,通过 128 个并发请求实现了每秒 1000 tokens 的生成速度,单用户下为 80 t/s。