@BenjaminDEKR: 很多人表现得好像 Grok 4.6 刚刚击败了 Anthropic 和 OpenAI,但实际上并没有。Grok 4.6 的数字显示…
摘要
对 Grok 4.6 基准测试结果的评论,认为 xAI 并未击败 Anthropic 或 OpenAI,但仍在中上游区间保持竞争力。
很多人表现得好像 Grok 4.6 刚刚击败了 Anthropic 和 OpenAI,但实际上并没有。
Grok 4.6 的数据显示,xAI 并未退出竞争,但*也没有*位居榜首。
与竞争对手即将更新的模型相比,它处于中上游水平。
这表明 Grok 仍有活力,这是一件好事,但意义不同。
查看缓存全文
缓存时间: 2026/08/13 19:23
很多人表现得好像 Grok 4.6 刚刚击败了 Anthropic 和 OpenAI,但实际上并没有。
Grok 4.6 的数据显示 xAI 并未出局,但 也 不在顶尖之列。
在竞争对手已经准备更新模型之际,它处于中上之间的位置。
这表明 Grok 还有一口气,这固然是好事,但却是另一回事。
相似文章
SpaceXAI的Grok 4.6在Artificial Analysis Intelligence Index中得分61
SpaceXAI的Grok 4.6在Artificial Analysis Intelligence Index中得分61,与GPT-5.6 Sol和Claude模型一起跻身前沿,以较低成本展现出强大的智能体性能。
@TheAhmadOsman: Grok Build 中的 Grok 4.5 出乎意料地好,xAI 可能回归,Anthropic 可能失去从 SpaceX 租用的计算资源
Grok 4.5 在 Grok Build 中表现惊人,暗示 xAI 可能重回竞争行列,并可能切断 Anthropic 从 SpaceX 租用的计算资源。
@GergelyOrosz: 现在是时候看看AI能让AI实验室执行得有多快了:Grok Bot取得了巨大成功(我完全着迷了),并且是‘Claude…’时刻
这篇文章强调了Grok Bot作为知识工作变革性工具的成功,类似于Claude Code,并批评了像OpenAI、Anthropic和Google这样的AI实验室延迟发布类似产品,这可能导致市场份额的流失。
SpaceXAI的Grok 4.5在人工智能分析智能指数中得分54,位列第四
SpaceXAI的Grok 4.5在人工智能分析智能指数上获得54分,排名第四。
@rohanpaul_ai: Grok 4.6 在代理循环效率上击败 GPT-5.6 Sol,在相同的3次构建中花费13.11美元对比20.18美元。Grok 4.6'…
文章报道了一项比较 Grok 4.6 和 GPT-5.6 Sol 在编码任务代理循环效率的实验,显示 Grok 4.6 更具成本效益,模型调用更少且提示缓存有效。