有没有人也对Google DeepMind未能在这些数学基准测试中领先感到惊讶?

Reddit r/singularity 新闻

摘要

作者对Google DeepMind尽管在该领域有过基础性工作,却未能在数学AI基准测试中领先表示惊讶,同时提到OpenAI最近的进展。

看到 OpenAI 最近的进展让我感到惊讶,但更让我惊讶的是,相比之下 Google DeepMind 的出现次数如此之少。DeepMind 可以说在过去几年中,在 AI 数学领域所做的基础性工作比任何其他实验室都多,他们拥有 AlphaGeometry、AlphaProof、AlphaEvolve,以及关于推理和搜索的长期研究历史。如果一两年你问我哪个实验室会主导困难的数学基准测试,我大概会说是 DeepMind。这仅仅是因为 Gemini 的优化方式与 OpenAI 的模型不同吗?Google DeepMind 是更关注更广泛的产品能力,而不是推动前沿研究?或者你只是觉得这些问题不太相关?我有点惊讶,在所有实验室中,DeepMind 竟然没有在一个历来是其最大优势之一的领域处于领先地位。你可以在这里看到更多关于这些统计数据的信息:https://vibemathed.com/stats ,以及 OpenAI 关于他们贡献的十个问题的最新博客:https://openai.com/index/ten-advances-in-mathematics/
查看原文

相似文章