专栏 AI 管理编年史 第 127/217 讲 查看课程目录

xAI发布Grok 4 Fast:思考token省40%、价格降98%,免费用户首次用上旗舰模型

19/09/2025 260
3:51
xAI发布Grok 4 Fast:思考token省40%、价格降98%,免费用户首次用上旗舰模型

xAI于2025年9月19日发布Grok 4 Fast,统一架构整合推理与非推理模式,200万token上下文并内置实时网页与X平台搜索,效能接近Grok 4但思考token省40%、价格降98%,即日起免费用户也能不受限使用。

xAI于2025年9月19日发布新一代推理模型Grok 4 Fast,主打“成本效益”定位。这款模型采用统一架构,将原本分开的推理模式(reasoning)与非推理模式(non-reasoning)融合到同一个模型中,由模型自行判断何时该深入思考、何时可直接作答,不需用户手动切换。Grok 4 Fast同时具备200万token的超长上下文窗口,并内置实时网页搜索与X平台(原Twitter)搜索能力,可直接抓取最新信息作答,而非仅依赖训练时的静态知识。

官方公布的效能数据显示,Grok 4 Fast在多项基准测试中的表现与前代旗舰Grok 4相近,但平均只需少40%的思考token即可达到同等效能。搭配大幅降低的定价,整体使用成本较Grok 4下降达98%。更关键的是,xAI宣布Grok 4 Fast即日起开放给所有用户,包含免费账号,这是免费用户首次能不受限制使用xAI的最新旗舰等级模型。

统一架构:省下的不只是钱,是“思考的浪费”

过去多数推理模型必须在“快但浅”与“慢但深”之间让用户手动选择,容易发生两种浪费:简单问题被丢进慢速推理模式空耗算力,或复杂问题被误放进快速模式导致答错。Grok 4 Fast把判断权交还给模型本身,由系统依问题难度动态决定思考长度,这也是官方所称“思考token省40%”的技术来源——省下的不是省略步骤,而是省略了不必要的思考。

与同期竞品的定位差异

相较于2025年8月推出、强调顶尖推理能力的GPT-5、Claude Opus 4.1,Grok 4 Fast策略明显是“够好且够便宜”,对准日常高频率、轻量查询,而非追求跑分纪录。内置实时搜索让它在“时效性问题”上具备原生优势,这是依赖静态训练数据的模型较弱的一环。98%的价格降幅意味着同样预算下可执行的查询量大增,对客服机器人、内容审核等高频AI应用而言,成本结构出现质变。

“AI民主化”的实质意义

业界普遍将Grok 4 Fast免费开放解读为xAI“AI民主化”策略:降低使用门槛,让一般用户也能接触近旗舰等级的AI能力,扩大用户基数,也对仍将旗舰模型锁在付费墙后的竞争对手形成压力,“先普及、后变现”的路径与部分同业坚持高阶订阅制形成对比。

对管理者而言,这则新闻的意义不在于哪家模型跑分最高,而在于AI使用成本正快速逼近“可忽略不计”的临界点:当推理等级AI几乎免费、又能实时查证最新信息,企业内部原本因成本或授权而卡关的AI导入计划,此时值得重新评估是否已具备规模化的条件。

测验检核:验证你的理解
5 篇 · 答对 80% 通过,通过后计入学习履历 登录后即可测验
问 AI:这篇文章怎么用在我的管理上?
内容由 AI 根据本文辅助生成,仅供参考,请自行判断准确性。
下一讲・AI 管理编年史 谷歌发布Gemini 2.5 Flash与Flash-Lite更新版 效率大幅提升

相关文章

我们使用必要 Cookie 维持登录与语言设置,并记录使用行为以改善服务。你可以只保留必要项目。 隐私权政策