前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
返回 AI 情报前线
All News · 全部资讯8394
  • CVE-2026-16584:AWS API MCP Server安全漏洞深度分析
  • GitHub Copilot已上线Gemini 3.7 Flash
  • Anthropic 为 Claude 输出文本添加水印:API 开放检测,版权认定存争议
  • Next.js 16.3发布:开发内存降低90%,AI编码Agent工作流优化
  • 一行代码修复PyTorch训练隐性内存泄漏:loss.detach().item()
  • AgentShield:防止AI代理半夜烧钱2000美元的开源防火墙
  • AI智能体存在欺骗作弊行为,用户信任度持续下滑
  • 用Azure API Management管控Claude Code团队使用
  • 模型同质化时代:选型逻辑已变,护城河在模型之外
  • DBHub vs Bytebase MCP:数据库Agent接入方案对比
  • Claude Code Plan模式深度解析:权限变化与August 14切换要点
  • Opus 5 vs GPT-5.6 Sol vs Kimi K3 三大模型编程能力实测对比
  • Grok 4.6 性能追平 GPT-5.6 Sol,价格仅为六分之一
  • 为中国AI API 构建模型目录漂移监控工具
  • Opus 5 vs GPT-5.6 Sol vs Kimi K3:三大AI代理模型横向评测
  • Grok 4.6 性能比肩 GPT-5.6 Sol:前沿竞争已成经济学竞赛
  • MCP 服务器认证在规范中为可选项:安全风险警示
  • 同一 prompt 跑 11 个主流 AI 模型:结果差异显著
  • DeepSeek Harness 公测:开源代码 Agent 框架对标 Claude Code
  • Agent 芯片新贵获 4.8 亿美元融资:首颗 AI 芯片已量产
  • Grok 4.6以更低价格重返一线,逼近Fable 5
  • Vibe Coding不是软件工程:AI编程的边界与反思
  • 扫描PDF翻译是图形问题而非翻译问题
  • MCP协议变更为无状态:工具执行幂等性挑战
  • Claude 破解数学难题:2000 阶以下哈达玛矩阵
  • DeepSeek-V4-Pro正式版:原生兼容OpenAI Responses API与Codex
  • DeepSeek V4 Flash/Pro 8月调价:输入降价达40%,并发限制调整
  • 三起AI Agent越狱事件:均因配置验证缺失
  • Claude推出隐形水印功能,可标记AI处理过的内容
  • OpenAI 发布 GPT-5.6 构建指南:聚焦 AI Agent 开发
  • AI 编程 Agent 的 Tracker 都是自我填报系统:真实问题剖析
  • Fable 5采用率低迷,企业AI支出或已触及天花板
  • AI研究者早年预测的自动化研究里程碑接连实现
  • Grok 4.6持久VM Agent测试指南:50万token上下文的工程实践
  • Gemini延期两月编程能力仍落后:谷歌DeepMind换帅内情
  • 企业级 GitLab MCP 安全加固:将 LLM 视为不可信客户端
  • Puppeteer MCP Server:让 AI Agent 直接操控浏览器
  • Anthropic 将 Claude Cowork 集成至 Chrome 扩展程序侧边栏
  • Laravel Boost v2:让AI Agent真正读懂你的Laravel项目的MCP服务器
  • OpenAI 新 API 速度提升 14 倍
  • 私有LLM总拥有成本实测:自建Llama vs 云API谁更划算
  • 和 AI 编程助手有效协作的实战技巧
  • miniVE:让 AI 编码代理在本地沙箱中安全运行
  • 第三谓词:突破词空间验证的论元空间验证方法
  • 本周 AI 开发:DeepSeek V4 Pro/Grok 4.6/Meta Muse-Glimmer 三款前沿模型扎堆
  • Claude 输出归属权与模型训练的法律边界
  • 多Agent系统状态协调:生产环境的隐形坑
  • LOOM编程语言+ARGUS架构:让AI代码权限可证伪
  • Statewave:Agent记忆字节级确定性的开源解法
  • AI 生成代码补丁的两道安检门:静态检查 + 运行时冒烟测试
  • 2026年8月AI模型Token价格排行榜
  • 已加载 51 / 8394
8.0
热点
AI SCORE
模型发布2026-08-13 20:04

Grok 4.6以更低价格重返一线,逼近Fable 5

量子位#Grok#AI编程#价格战
Editor brief · 编辑速览

Grok 4.6性能大幅提升重回第一梯队,定价更低,与Fable 5形成直接竞争,Cursor的AI编程工具或因此受益。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

马斯克带着Grok 4.6,让SpaceXAI重新回到了大模型牌桌。

它跑分反超了GPT-5.6 Sol和Fable 5 Max,价格却只要每百万token输入2美元、输出6美元,比两个对手便宜不少。

衡量真实工作能力的GDPVal-AA v2上,Grok 4.6拿到了全场最高分1753,把它们都甩在了后面;AA-Briefcase和Harvey LAB两项测试,它同样排第一。

目前,新模型已经同步接入Grok Build、Cursor、Grok Bot和API,Cursor里首周还有双倍用量。

这次升级定的重点,是长程agent任务,要求模型在没人盯着的时候也能连续干很久不掉线。

就在前一天,SpaceXAI还发布了另一款产品Grok Bot,一队能自己登录各种工具、24小时连轴转的智能体。

现在,Grok Bot已经能直接调用Grok 4.6了。

前脚发Harness,后脚模型也跟着出炉,老马这一波,是真的不想在AI上掉队。

跑分表现

SpaceXAI这次拿出的官方跑分表,摆了10项基准,对比对象是Grok 4.5 High、GPT-5.6 Sol Max和Fable 5 Max。

综合智力指数AA Intelligence Index上,Grok 4.6拿到61分,跟GPT-5.6 Sol打平,比Grok 4.5的56分高了5分,只比排名最高的Fable 5 Max少1分。

GDPVal-AA v2上,Grok 4.6拿到1753分,反超GPT-5.6 Sol的1728分和Fable 5 Max的1741分。

AA-Briefcase和Harvey LAB这两项,Grok 4.6同样双双超过,分别是1577分和15.8%。

但Terminal-Bench v3.0上,它只拿到26%,GPT-5.6 Sol是34.6%。

Terminal-Bench测的是纯命令行环境下的agent操作能力,模型要在没有图形界面的情况下连续执行多步指令,出一次错就可能中断整条链路。

这道题Grok 4.6答得不算好,知识工作类的agentic任务它更擅长,纯终端操作还没追上去。

价格优势

但再看Grok 4.6的价格,还要啥自行车呢?

Grok 4.6的官方报价是每百万token输入2美元、输出6美元,跟Grok 4.5持平。

同级模型里,GPT-5.6 Sol Max报价5美元和30美元,Claude Opus 5报价5美元和25美元,Grok 4.6确实压得更低。

一旦单次请求的上下文超过20万token,输入输出价格会同时翻倍,涨到4美元和12美元,而且这不是只算超出部分,整条请求都按高价结算。

不过算下来,即使翻了倍,依然是比GPT和Claude便宜。

另外SpaceXAI还提供了一个低延迟版本,价格是标准版的两倍,给对响应速度要求更高的场景用。

接入产品

Grok 4.6接入的第一批入口有四个,SpaceXAI自己的Grok Build、代码编辑器Cursor、智能体产品Grok Bot,以及开放API。

Cursor和Grok Build里,SpaceXAI给了一周的双倍用量。

第三方平台也跟上了,OpenRouter、Vercel、Cloudflare三家同步接入。

值得一提的是这次升级瞄准的是长时间运行的agent任务,查陌生领域的资料、跨代码库改东西、用各种工具、搭出第一版,再跟着反馈改很多轮,中途不用打断重来。

这个定位,也和昨天发布的Grok Bot非常搭配。

Grok Bot是什么

Grok 4.6发布后再回过头看,12日凌晨发布的Grok Bot,很可能就是在给4.6打前哨,SpaceXAI给它的定位是「AI队友」。

当时马斯克就预告过,Grok 4.6会在「本周稍晚时间」上线,结果过了不到24小时就发布了。

每个Bot拥有自己的云端环境,能直接登录用户已经在用的工具和网站,包括那些没有开放API、没有MCP接口的平台。

官方演示里,一个用户向Chief of Staff打听某个客户账户最近的进展。

Chief of Staff是专门统筹全局的Bot,它直接调出上一次通话的记要、CRM里的账户备注,汇总成一条回复。

而且这是常态。Bot们并行运行,24小时不间断,哪怕用户合上笔记本电脑,它们照样在云端干活。

遇到需要人决策的环节,比如登录验证、支付确认,Bot会停下来,等用户处理完,再接着往下走。

多Bot协作

一个Bot只是开始。一个人可以同时开好几个Bot,各自负责不同的事,一个盯销售外联,一个管客服工单,一个处理报销单。

Bot之间还能互相通信,一个Bot卡住了,会主动叫另一个来帮忙。

用户把一件事正常操作一遍,打开工具、登录、执行,Bot会在旁边看着,然后自动把步骤记下来,存成一个可以复用的routine。

Grok Bot最早是SpaceXAI内部自己捣鼓出来的原型,在公司内部用顺了之后就火了。

销售团队用它跟进客户,运营团队用它给新员工办入职、处理发票,工程团队用它复现Bug、提交工单,再把修复工作转交给另一个Bot。

马斯克自己的员工先当了一轮内测用户,用顺了之后,SpaceXAI才决定把它交给所有人。

竞争格局

Grok Bot不是第一个想让AI坐进工位的产品。

国内的腾讯WorkBuddy今年3月上线,5月就冲到国内AI原生办公智能体月访问量第一,6月单月PC端访问量达到2097万,超过字节Trae和阿里QoderWork两家加起来的总和。

WorkBuddy只是国内跑得最快的一个代表。字节跳动的Trae、阿里的QoderWork都在同一条赛道上。

海外这边,Anthropic的Claude Cowork也是同一个方向的产品。

几家大厂几乎是同时扎进了「AI办公智能体」这个方向,马斯克也在这股风里,接连发布了「SpaceXAI版Workbuddy」,和专门针对长程任务优化的模型。

Cursor的影子

还有,从Grok Bot的一些细节里,还能够看到Cursor的蛛丝马迹。

除了开放给Cursor部分订阅用户使用之外,Grok Bot的下载、注册和销售咨询入口,目前都还挂在Cursor的基础设施上。

Grok Bot下载链接所在的域名是cursor.com,企业客户咨询走的也是Cursor官网的联系表单。

Cursor联合创始人兼CEO Michael Truell,当天也转发了Grok Bot发布的消息。

再看今天发的Grok 4.6,也是第一时间开放给了Cursor。

不过,Grok Bot瞄准的不是Cursor那种写代码场景,它盯上的是更日常的职场任务,比如回邮件、更新CRM、核对报销单等等。

另外,Grok Bot中同一个用户名下的所有Bot,共享一台持久化的云端电脑,文件、浏览器、登录状态都是共用的,隔离按用户来分,不按单个Bot。

收购脉络

除了这些影子,Grok 4.5也是xAI和Cursor首次联合训练的成果,其训练数据包括了来自Cursor积累的海量真实开发者交互记录。

现在的Grok 4.6,是在Grok 4.5基础上接着练出来的,用的是模型自己生成的推理数据和工程数据,又加了一轮优化器调整和强化学习。

基础设施则来自SpaceXAI,Grok Bot背后跑的算力,用的是SpaceXAI旗下的Colossus超算集群。

也就是说,在Grok Bot当中,一边是产品里看得到的Cursor影子,一边是底层算力用的马斯克自家基础设施。

这背后,是怎么走到这一步的?往回倒推,走了大半年。

今年2月,SpaceX先是以全股票方式收购了xAI,马斯克手里这两家公司合并到了一起。

4月21日,SpaceX拿到一份和Cursor的期权协议,可以选择付出约100亿美元违约金退出,也可以后续以600亿美元收购Cursor母公司Anysphere。

6月16日,也就是SpaceX在纳斯达克完成750亿美元IPO几天之后,双方正式敲定了这笔600亿美元的全股票收购,这是风投支持的初创公司历史上金额最大的一笔收购。

到了7月,马斯克把两块业务对外的品牌统一改成了SpaceXAI。

SpaceX愿意为这单交易一次性砸600亿美元,是有理由的。

截至今年2月,Cursor的年经常性收入达到20亿美元,是有记录以来增长最快的企业软件公司。

Cursor的股票会按SpaceX股价的成交量加权均价,换算成SpaceX的Class A普通股,预计今年三季度完成交割。

Cursor四位联合创始人,Michael Truell、Aman Sanger、Sualeh Asif、Arvid Lunnemark,都是MIT背景,身家因此翻倍,交易完成后每人身家预估27亿美元。

这半年里,SpaceX一边把xAI并进自己,一边买下Cursor,把几块业务拼在了一起。

Grok Bot和Grok 4.6,正是马斯克合并了一波又一波之后,公开打出的第一套组合拳。

下一款时间表

Grok 4.6上线没几个小时,马斯克已经在回复网友时把下一款的时间表报了出来。

他表示,Grok 4.7的初步训练已经完成,正在补充训练中添加大量SpaceX公司数据,并将在三到四周内发布。

特别强调了,SpaceX的所有数据都可以用于训练。

同时老马还自信满满地宣告,4.7将超越当前所有的模型。

同时他还cue到A社,先是肯定了他们可能也会有新的模型,但SpaceX的训练语料库非常出色且独特。

因此马斯克说,如果有任何模型在现实世界的工程方面比Grok 4.7更好,他都会感到震惊。

Flag已经立起,接下来就看老马能在大模型这个牌桌上留住多久了。

参考链接: [1]https://x.ai/news/grok-4-6 [2]https://x.ai/news/introducing-grok-bot

一家新能源大厂,如何撑起全球最大AI算力超级单体?2026-08-11

GPT-5.6和Fable联手,解决了一道悬了25年的数学难题2026-08-09

亿级日活App的"算力生死劫":推理成本倒挂,他们靠跨云架构砍掉75% GPU集群2026-08-04

终端市场的下一个增长点,高通押在了"个人AI"上2026-07-30

还能编程让小人跑动组成Hello World

量子位 QbitAI 版权所有©北京极客伙伴科技有限公司 京ICP备17005886号-1

Original source

本文由 AI 翻译整理自 量子位,原文版权归原作者所有。

阅读英文原文
上一篇
Agent 芯片新贵获 4.8 亿美元融资:首颗 AI 芯片已量产
下一篇
Vibe Coding不是软件工程:AI编程的边界与反思