@FinanceYF5: 1/ Grok 4.6刚刚发布。 价格和4.5一样。 Agent更强。编程更好。复杂任务跑得更久。 AA Intelligence Index追平GPT-5.6 Sol。 每百万输入Token 2美元,输出Token 6美元。

X AI KOLs Timeline 模型

摘要

Grok 4.6 正式发布,定价与 4.5 相同,Agent 能力和编程能力增强,复杂任务跑得更久,AA Intelligence Index 追平 GPT-5.6 Sol,输入每百万 Token 2 美元、输出每百万 Token 6 美元。

1/ Grok 4.6刚刚发布。 价格和4.5一样。 Agent更强。编程更好。复杂任务跑得更久。 AA Intelligence Index追平GPT-5.6 Sol。 每百万输入Token 2美元,输出Token 6美元。👇 https://t.co/jmdP1F8DUH
查看原文
查看缓存全文

缓存时间: 2026/08/13 21:24

1/ Grok 4.6刚刚发布。

价格和4.5一样。

Agent更强。编程更好。复杂任务跑得更久。

AA Intelligence Index追平GPT-5.6 Sol。

每百万输入Token 2美元,输出Token 6美元。👇 https://t.co/jmdP1F8DUH

1/ Grok 4.6 just released.

Price same as 4.5.

Agent stronger. Programming better. Complex tasks run longer.

AA Intelligence Index catches up to GPT-5.6 Sol.

$2 per million input Tokens, $6 per million output Tokens.

2/ 这次升级的重点不是“回答得更聪明”。

而是让Agent连续工作更久。

研究陌生领域、分析资料、修改整个代码库,再把一个想法做成可以使用的应用或工作成果。

3/ 给Grok 4.6一个产品想法,它可以自己研究、搭建结构、完成核心交互,再根据反馈继续修改。

任务跑得足够长时,它还会主动测试和检查自己的工作。

Agent开始有点像真正的项目执行者了。

4/ 综合能力上:

Fable 5:62 Grok 4.6:61 GPT-5.6 Sol:61 Grok 4.5:56

但在GDPVal-AA知识工作评测中,Grok 4.6拿到1753分,超过Fable 5和GPT-5.6 Sol。

5/ 编程能力相比4.5也有明显提升:

DeepSWE:54% → 65.9% CursorBench:66.7% → 69.9% FrontierCode:56.6% → 61.3%

不过它并非全面第一,GPT-5.6 Sol和Fable 5仍在部分编程评测中领先。

6/ 这背后是一次比Grok 4.5更长的补充训练。

xAI加入了推理、工程和高级技术数据,又让Grok 4.5重新生成SFT轨迹。

强化学习则覆盖知识工作、通用编程、内核优化、网页开发和CAD等任务。

7/ Grok 4.6现已上线Cursor、Grok Build、API、OpenRouter、Vercel和Cloudflare。

普通版价格不变,Fast版本价格翻倍。

Cursor与Grok Build首周提供2倍包含用量,现在已经可以直接试了。

官方发布:

Grok Bot 已经席卷整个互联网,而且是有原因的。

它是一个非常优秀的 AI Agent。

但前提是,你必须用正确方式配置它。

前 5 个步骤,可以让你的 Grok Bot Agent 团队变得非常强

相似文章

Grok 4.6

Hacker News Top

xAI releases Grok 4.6, a frontier model focused on long-running agents and ambitious interactive/visual work, matching GPT-5.6 Sol on the Artificial Analysis Intelligence Index and available in Cursor and Grok Build.