DC娱乐网

Grok 4.6 发布!紧追 GPT-5.6 和 Fable 5 8 月12

Grok 4.6 发布!紧追 GPT-5.6 和 Fable 5

8 月12 日晚,Grok 4.6 正式发布。本次升级重点放在 long-running agents:让模型能够在更多步骤里持续完成研究、信息分析、跨代码库开发,以及把一个产品想法逐步做成可工作的应用;在更长的执行轨迹中,xAI 还观察到了更多 self-testing 和 verification。

从官方公布的评测看,Grok 4.6 已基本进入头部模型的竞争区间。
1️⃣AA Intelligence Index 为 61,与 GPT-5.6 Sol Max 持平;
2️⃣GDPVal-AA v2 得分 1753,高于 GPT-5.6 Sol Max 的 1728 和 Fable 5 Max 的 1741;
3️⃣AA-Briefcase 以 1577 略高于两者,Harvey LAB 也取得 15.8%。
不过 DeepSWE 和 Terminal-Bench 等 Coding 评测仍落后于两款模型。

价格则是 Grok 4.6 更突出的地方。只看官方 API 基础 token 单价,短上下文 Grok 4.6 为 $2/百万输入 tokens、$6/百万输出 tokens;相比而言,GPT-5.6 Sol 为 $5/$30,Claude Fable 5 为 $10/$50。即使 prompt 达到 200K 后,Grok 4.6 提升至 $4/$12,基础价格依然具有竞争力。

能力提升背后,xAI 延长了 supplemental training,重新生成覆盖不同 reasoning effort、agent harness、软件工程和 knowledge work 的 SFT trajectories,并继续在通用 Coding、Kernel Optimization、Web Development、CAD 等 Agentic RL 环境中训练。

用户目前可通过 grok-4.6 调用模型,支持 500K Context、图文输入以及 low / medium / high / xhigh 四档推理强度,并已进入 xAI API、Grok Build、Cursor、OpenRouter、Vercel 和 Cloudflare 等渠道。

grok Agent 长程任务 CodingAgent AI编程 Claude大模型 Fable5