8.0
热点
AI SCORE
模型发布2026-08-13 02:33
Grok 4.6 性能持平 GPT-5.6,价格低 60%
The Decoder#xAI#Grok#大模型
Editor brief · 编辑速览
xAI 的 Grok 4.6 在基准测试中与 GPT-5.6 Sol 持平,Agent 任务步数仅需 Claude Opus 5 的一半,定价低 60% 以上。
Grok 4.6 在大幅降低成本的同时追上了前沿模型。根据 Artificial Analysis Intelligence Index,SpaceXAI 的新模型得分为 61 分,与 OpenAI 的 GPT-5.6 Sol 持平。只有 Anthropic 的 Claude Opus 5(63 分)和 Claude Fable 5(62 分)得分更高。相较于前代 Grok 4.5,这是一次 5 分的跃升。
Grok 4.6 在 AA Index 中与顶尖梯队持平,该指数将多个基准测试汇总为一个综合评分。| 图片来源:Artificial Analysis

Grok 4.6 在 Agent 任务上表现尤为出色,这类任务要求模型独立执行多步骤工作流。在 GDPval-AA v2 基准测试(旨在衡量真实世界计算机知识工作)中,它以 1753 的 Elo 分数排名第二,仅次于 Claude Opus 5。Grok 4.6 完成复杂任务大约需要 53 个步骤,而 Claude Opus 5 则需要约 103 个步骤。
定价维持在每百万 token $2/$6,比 Claude Opus 5($5/$25)和 GPT-5.6 Sol($5/$30)便宜超过 60%。Grok 4.6 现已通过 API、Cursor、Grok Build 以及 OpenRouter、Vercel 和 Cloudflare 等合作伙伴可用。上线首周,x.ai 在 Grok Build 和 Cursor 中提供双倍使用配额。