xAI发布Grok 4 Fast:思考token省40%、价格降98%,免费用户首次用上旗舰模型
xAI于2025年9月19日发布Grok 4 Fast,统一架构整合推理与非推理模式,200万token上下文并内置实时网页与X平台搜索,效能接近Grok 4但思考token省40%、价格降98%,即日起免费用户也能不受限使用。
xAI于2025年9月19日发布新一代推理模型Grok 4 Fast,主打“成本效益”定位。这款模型采用统一架构,将原本分开的推理模式(reasoning)与非推理模式(non-reasoning)融合到同一个模型中,由模型自行判断何时该深入思考、何时可直接作答,不需用户手动切换。Grok 4 Fast同时具备200万token的超长上下文窗口,并内置实时网页搜索与X平台(原Twitter)搜索能力,可直接抓取最新信息作答,而非仅依赖训练时的静态知识。
官方公布的效能数据显示,Grok 4 Fast在多项基准测试中的表现与前代旗舰Grok 4相近,但平均只需少40%的思考token即可达到同等效能。搭配大幅降低的定价,整体使用成本较Grok 4下降达98%。更关键的是,xAI宣布Grok 4 Fast即日起开放给所有用户,包含免费账号,这是免费用户首次能不受限制使用xAI的最新旗舰等级模型。
统一架构:省下的不只是钱,是“思考的浪费”
过去多数推理模型必须在“快但浅”与“慢但深”之间让用户手动选择,容易发生两种浪费:简单问题被丢进慢速推理模式空耗算力,或复杂问题被误放进快速模式导致答错。Grok 4 Fast把判断权交还给模型本身,由系统依问题难度动态决定思考长度,这也是官方所称“思考token省40%”的技术来源——省下的不是省略步骤,而是省略了不必要的思考。
与同期竞品的定位差异
相较于2025年8月推出、强调顶尖推理能力的GPT-5、Claude Opus 4.1,Grok 4 Fast策略明显是“够好且够便宜”,对准日常高频率、轻量查询,而非追求跑分纪录。内置实时搜索让它在“时效性问题”上具备原生优势,这是依赖静态训练数据的模型较弱的一环。98%的价格降幅意味着同样预算下可执行的查询量大增,对客服机器人、内容审核等高频AI应用而言,成本结构出现质变。
“AI民主化”的实质意义
业界普遍将Grok 4 Fast免费开放解读为xAI“AI民主化”策略:降低使用门槛,让一般用户也能接触近旗舰等级的AI能力,扩大用户基数,也对仍将旗舰模型锁在付费墙后的竞争对手形成压力,“先普及、后变现”的路径与部分同业坚持高阶订阅制形成对比。
对管理者而言,这则新闻的意义不在于哪家模型跑分最高,而在于AI使用成本正快速逼近“可忽略不计”的临界点:当推理等级AI几乎免费、又能实时查证最新信息,企业内部原本因成本或授权而卡关的AI导入计划,此时值得重新评估是否已具备规模化的条件。