SpaceXAI 发布 Grok 4.6:50 万上下文、没换底座、定价却分两段
SpaceXAI(原 xAI)于 2026-08-12 正式发布 Grok 4.6,上下文窗口 50 万 tokens,主打长时间运行的智能体。它沿用与 Grok 4.5 相同的 1.5T V9 底座,增益全部来自后训练;定价以 20 万 prompt tokens 为分水岭,超过即整笔翻倍计价。官方自报 Intelligence Index 61 追平 GPT-5.6 Sol,第三方尚未复现。
SpaceXAI(原名 xAI)于 2026 年 8 月 12 日正式发布前沿模型 Grok 4.6。官方公告将其定位为「面向程序开发、智能体任务与知识工作的前沿模型」,并明确表示「Grok 4.6 建立在 Grok 4.5 之上,特别聚焦于长时间运行的智能体,以及更有企图心的交互式与可视化工作」。同一天,x.ai 的公告页与 docs 文档条目一起上线,API 即刻可调用。
规格:50 万上下文、图文输入
模型 ID 为 grok-4.6,上下文窗口 500,000 tokens,模态为文本+图片输入、文本输出,支持 function calling、structured outputs 与 reasoning。速率上限为每秒 150 次请求、每分钟 50,000,000 tokens,区域可用性为 us-east-1 与 us-west-2。上线渠道包含 Cursor 代码编辑器、Grok Build 工具与 API,并同步登陆多个合作平台。
定价分两段,20 万是分水岭
官方定价页揭示了一个容易被忽略的细节(每百万 tokens):
- prompt tokens 在 20 万以下:输入 2.00 美元/缓存输入 0.50 美元/输出 6.00 美元;其中输入与输出费率与 Grok 4.5 相同。
- 一旦超过 20 万门槛:整笔请求(不是只有超出的部分)重新计价为输入 4.00 美元/缓存输入 1.00 美元/输出 12.00 美元。
换句话说,「50 万上下文」在成本上其实是两段式的,跨过门槛等于整笔翻倍。
反直觉之处:这次没有换底座
Grok 4.6 并不是新的基础模型,它沿用与 Grok 4.5 相同的 1.5T 参数 V9 底座,增益全部来自后训练:延伸的补充训练(使用精选的模型生成数据)、以 Grok 4.5 重新生成 SFT 轨迹,以及横跨知识工作、编码与领域专属环境的智能体式强化学习。官方把行为差异描述为「多步骤复杂任务中更能撑住」「更多自我测试与验证」。
性能方面,SpaceXAI 自报 Artificial Analysis Intelligence Index 得分 61,追平 GPT-5.6 Sol(Grok 4.5 为 56);SpaceXAI 官方页面另载 DeepSWE v1.1 65.9%、Terminal-Bench v3.0 26%、GDPVal-AA v2 1753,同属厂商自报。截至 2026 年 8 月 12 日,尚无第三方独立复现。
从「下周推出」到真的交付,隔了好几周
Grok 4.6 自 2026 年 7 月起就被 Musk 多次口头预告,说法在「下周」与「本周稍后」之间反复;但自首次预告之后的数周间,官方端始终没有 model card、没有 API model ID,也没有定价,期间多家第三方媒体反复误报为「已发布」。直到 8 月 12 日公告页与 docs 条目同时出现,才是真正交付。
对管理者的意义,这则新闻留下两个提醒:
- 评估 AI 供应商时,该看的是「有没有 model ID、有没有定价页」,而不是高层的口头预告——两者之间往往差好几周。
- 引入长上下文智能体之前先把门槛算清楚:若工作流常态落在 20 万附近,刻意压在门槛以下与放任超过,账单可能差一倍。
能不能用,看的是可调用的凭据,不是预告。