@elonmusk: Grok Build
摘要
Grok 4.5 配合 Grok Build 在 SWE-Atlas-QnA 基准测试中以 84 分获得第一名,与 GPT-5.6 Codex 持平,并超越其他编码设置。
Grok Build
查看缓存全文
缓存时间: 2026/07/10 22:17
Grok Build
X Freeze (@XFreeze): 搭载 Grok Build 的 Grok 4.5 刚刚在 SWE-Atlas-QnA 基准测试中以 84 分排名第一
这一成绩使其与 GPT-5.6 (max) Codex 持平,并超越了 Claude Code Fable 5 (max)、Opus 4.8 (max) 以及所有其他经过测试的编码方案
Grok Build 现在是用于
相似文章
@elonmusk:Grok 4.6 在 CursorBench 真实编码测试中排名第一
Elon Musk 宣布,Grok 4.6 在 CursorBench 真实编码测试中排名第一,超越其他 AI 模型,展现出高效率。
@elonmusk: Grok
埃隆·马斯克分享了一个工作流程,使用Grok 4.5进行各项开发任务,同时还有Fable 5和GPT-5.6 Sol,强调了一个实时研究和编码设置。
@elonmusk: Grok Build 的改进速度快如闪电
埃隆·马斯克宣布,Grok Build 正在快速改进,一名用户报告称,在 xAI 的隔夜更新后,性能显著提升。
@elonmusk: Grok
Aravind Srinivas 祝贺 SpaceXAI 推出 Grok 4.6,指出它在使用 Perplexity Computer 工具链的 Wide-And-Deep-Research 基准测试中表现出色,现已向 Pro 和 Max 用户开放。
@elonmusk: Grok 4.5 在 Long-Horizon Terminal-Bench 上排名第一
埃隆·马斯克宣布,Grok 4.5 在 Long-Horizon Terminal-Bench 基准测试中排名第一,超越了之前的模型。