为什么一些实验室在算力远少的情况下追赶得这么快?

Reddit r/ArtificialInteligence 新闻

摘要

作者质疑为何一些海外AI实验室能用远少于前沿水平的算力迅速赶超前沿模型,并推测高质量专家训练数据的重要性可能远超人们的想象——同时声称像SurgeAI这样的美国数据实验室正在向中国大规模出售数据,从而削弱美国在AI竞赛中的地位。

芯片限制的核心逻辑是:前沿AI需要海量算力,对吧?但海外一些资源只有零头的实验室,却不断推出接近顶尖水平的模型,而且成本低得多。这是怎么做到的?我怀疑高质量训练数据的重要性可能比大家想象的要大得多。目前对华销售并没有任何限制,而像SurgeAI这样的美国数据实验室正在向中国大规模出售专家训练数据,这正在削弱美国在这场竞赛中的优势。
查看原文

相似文章

中国AI实验室有何不同?

Reddit r/artificial

这篇文章质疑为什么中国AI实验室在投资较少的情况下取得了比美国实验室更好的结果,并考虑了效率、训练后技术和数据获取等因素。

硅谷的另一个中国问题:它在训练他们的AI

Reddit r/ArtificialInteligence

这篇《福布斯》文章揭露,像Surge AI和Mercor这样的美国数据标注初创公司正秘密向中国AI实验室出售高质量训练数据,尽管美国实施了芯片限制,但这帮助中国缩小了与美国AI的差距。文章强调了数据基础设施在AI军备竞赛中被忽视的作用,以及围绕专有数据出口的监管盲区。