xAI正式发布Grok 4与Grok 4 Heavy:号称全球最聪明模型
xAI于2025年7月9日直播发布Grok 4与更强版本Grok 4 Heavy,用20万张GPU的Colossus集群训练,运算效率较前代提升6倍,并整合原生工具调用与实时搜索。
xAI于2025年7月9日通过直播正式发布新一代模型Grok 4,以及功能更强的Grok 4 Heavy。发布会上,xAI强调这两款模型是用旗下拥有20万张GPU的Colossus超级集群,以强化学习方式训练而成。Grok 4具备25.6万token的上下文窗口,官方数据显示其运算效率较前代提升达6倍。模型内置原生工具调用能力,并整合实时搜索功能,可在对话过程中主动查询最新信息。Grok 4开放给SuperGrok与Premium+订阅用户使用,企业与开发者也可通过xAI API直接接入。xAI在发布会上宣称,Grok 4是“全球最聪明的模型”。
强化学习训练与大型GPU集群的意义
相较于单纯扩大模型参数,xAI这次特别强调训练方法本身——用强化学习搭配20万张GPU级别的运算规模,代表训练投入已进入超大规模基础设施竞赛阶段。这也呼应了近几个月各家厂商在训练基础设施上的持续加码(如NVIDIA早前发布的NVLink Fusion),显示模型能力提升的关键战场,已从单纯的模型架构创新,延伸到训练集群规模与强化学习方法的组合运用。
原生工具调用与实时搜索:与前代的差异
Grok 4最值得关注的功能升级是“原生”工具调用与实时搜索整合——不需额外插件或复杂的提示工程,模型本身就能判断何时该查资料、何时该调用工具。这与OpenAI在6月推出的ChatGPT Business连接器方向类似,反映出主要模型供应商正把“模型能自主行动”视为下一阶段的竞争重点,而不只是比拼知识量或推理分数。25.6万token的上下文窗口也让Grok 4能处理更长的文档与对话历史,适合需要长篇分析的场景。
行业反应:订阅分层与“最聪明”宣称
Grok 4与更高阶的Grok 4 Heavy采分层开放——普通能力给SuperGrok与Premium+订阅用户,企业则通过API接入,这是目前主流模型厂商通用的商业模式。至于“全球最聪明模型”的宣称,市场普遍会等待第三方基准测试与实际使用反馈验证,毕竟每家厂商在自家发布会上都倾向强调自身优势指标,实际表现仍需经过时间与跨模型比较才能定论。
对管理者的意义
对管理者而言,Grok 4这类具备实时搜索与工具调用能力的模型,代表AI助理未来能更主动地协助处理需要查证最新信息的任务(如市场动态、竞品信息、法规更新),而不只是回答训练数据截止前的知识。若团队正在评估AI工具导入,可留意“能否自主查资料并行动”这项能力,将逐渐成为选型时的重要判断标准之一。