基准最大化

Reddit r/ArtificialInteligence 新闻

摘要

讨论了OpenAI市场份额下滑,而Meta和Google却在增长的问题,质疑高基准分数对普通用户是否重要,并提出AI的真正价值在于作为现有产品生态系统中的一项功能。

OpenAI的市场份额一直在下滑,而Meta和Google的份额却在增长。对于普通AI用户来说,当拥有最高基准测试分数的前沿模型并未如预期般增长时,真正重要的是什么?我认为AI对于那些已经拥有产品和生态系统、可以将AI作为功能使用的公司来说非常有效。
查看原文

相似文章

Meta追赶AI的内幕

Ars Technica

一份关于Meta在AI领域追赶努力的详细报告,包括招募Alexandr Wang和发布Muse Spark模型,对其进展评价不一。

Arena.ai 可能正在运行迄今为止最欺诈性的基准测试

Reddit r/singularity

这篇文章批评 Arena.ai 涉嫌运行不诚实的基准测试,声称其将 GPT 5.5 在编程能力上排在 Meta 的 Muse Spark 之下,并将 Grok Imagine 在视频生成方面排在 Seedance 之上,作者断言这是客观错误的。