xAI发布旗舰模型Grok 3,马斯克称训练算力达上代10倍
xAI于2025年2月17日发布新一代旗舰模型Grok 3,训练运算量为Grok-2的10倍,官方宣称在数学推理与科学测试上超越GPT-4o,同时推出轻量版Grok 3 mini。
xAI于2025年2月17日发布新一代旗舰模型Grok 3。首席执行官马斯克表示,Grok 3的训练运算量是上代Grok-2的10倍,使用内含约20万张GPU的Colossus数据中心训练而成——这是目前业界公开规模最大的单一训练集群之一。官方宣称Grok 3在AIME数学推理与GPQA博士级科学题目等基准测试上超越OpenAI的GPT-4o。同时xAI也发布轻量版Grok 3 mini,以牺牲部分准确度换取更快的响应速度,瞄准需要实时互动的应用场景。初期Grok 3仅开放给X平台Premium+与xAI的SuperGrok订阅用户使用,企业API接入则预告稍后开放。
技术意义:算力堆叠仍是这一阶段的主战场
Grok 3最引人关注的不是功能创新,而是“10倍算力”与“20万张GPU集群”这两个数字本身。这说明截至2025年初,头部AI公司的竞争仍高度依赖运算规模的扩张,而非单纯的算法巧思。Colossus数据中心的规模也重新定义了“旗舰模型”的入场门槛——能投入如此算力的公司屈指可数。
与竞品比较:直接对标GPT-4o的基准测试策略
xAI选择在AIME(数学)与GPQA(博士级科学)这两项高难度推理基准上与GPT-4o正面比较,显示Grok 3的定位是“推理能力”而非泛用对话体验。同时推出的Grok 3 mini则对应OpenAI o3-mini、Google Gemini Flash等“轻量高速”模型路线的市场区隔——显示各厂商已普遍采用“旗舰版+轻量版”双轨策略。
业界反应:订阅墙先行、企业市场后补
Grok 3初期只绑定X Premium+与SuperGrok订阅,而非立即开放API,这与OpenAI、Anthropic惯用的“先开API抢开发者”策略不同,反映xAI更倚重马斯克旗下X平台的既有用户基础作为初期导流渠道,企业级应用要等后续开放才能评估。
对管理者的意义
对管理者而言,这则新闻的信号不在于“该不该换用Grok”,而在于提醒:AI模型的能力仍在快速迭代,且不同厂商正走向“旗舰+轻量”双轨供应,管理者评估导入AI工具时,应同时比较高阶推理需求与日常快速响应需求,避免只锁定单一模型或单一厂商。