为什么前沿实验室不透露训练数据量?

Reddit r/ArtificialInteligence 新闻

摘要

文章质疑为何OpenAI和Anthropic等前沿AI实验室不公开其训练数据规模,暗示模型性能提升可能源于数据量而非真正的智能。

当你查看OpenAI或Anthropic的模型卡时,它们不会报告训练所用的数据量。我并不是建议它们告诉我们训练的具体*内容*,只是一些总数据量的准确估计。它们为什么不报告?因为一个不光彩的秘密可能是:这些模型变得更好的原因只是因为有更多数据可以复制。它们并非真的那么'智能',而只是更大更好的数据库查询。
查看原文

相似文章

真正的AI竞赛可能已不再处于前沿

TechCrunch AI

本文讨论了开放权重模型(尤其是来自中国公司的模型)在生产型AI工作负载中日益占据主导地位,这挑战了像Anthropic和OpenAI这样的公司的前沿模型的相关性。