专栏 AI 管理编年史 第 147/217 讲 查看课程目录

Mistral AI发布Mistral 3系列:675B参数旗舰模型全面开源

02/12/2025 225
3:55
Mistral AI发布Mistral 3系列:675B参数旗舰模型全面开源

法国创业公司Mistral AI于2025年12月2日发布Mistral 3系列模型,旗舰Mistral Large 3采用稀疏混合专家架构、总参数达675B,并推出三款面向边缘设备的Ministral 3小模型,全系列以Apache 2.0协议开源。

法国AI创业公司Mistral AI于2025年12月2日发布新一代模型阵容「Mistral 3系列」,包含一款旗舰模型和三款轻量模型,全部以Apache 2.0协议完全开源。旗舰模型Mistral Large 3采用稀疏混合专家(Mixture-of-Experts,MoE)架构,总参数规模达675B,但每次推理仅激活41B参数,兼顾模型容量与运算效率。该模型内置视觉编码器,可处理图文混合输入,并支持长达25.6万token的上下文窗口,足以一次读入数百页文档。官方强调,Mistral Large 3是完全从零开始训练,使用3000张NVIDIA H200 GPU完成,并非在现有模型基础上微调扩充。

同步推出的Ministral系列则面向边缘设备与本地部署,提供14B、8B、3B三种规模,每种规模再各自推出Base(基础预训练)、Instruct(指令调优)、Reasoning(推理强化)三种变体,相当于一次推出九款小型模型,让开发者依硬件条件与应用需求灵活选用。

技术意义:稀疏架构降低推理成本

MoE架构的核心价值在于「总容量大、实际运算量小」——675B总参数理论上能存储更丰富的知识,但通过路由机制只激活41B参数处理单次请求,使推理成本与延迟更接近中型模型。这种设计已是2025年主流大模型的共通路线,Mistral此次是把它做到自研旗舰模型上,而非采购现有架构改装。

与同期发布的比较:小模型阵容是差异化重点

相较于11月Anthropic、OpenAI、Google聚焦在旗舰级模型的能力刷新,Mistral 3系列更明显的差异化在于Ministral小模型阵容的完整性:3B到14B、三种变体全开源,直接对准企业本地部署与边缘运算市场,与Mistral长期主打「开源+可自建」的定位一致。官方同步宣布与NVIDIA、vLLM、Red Hat等厂商合作,确保模型能立即部署于多种硬件与推理框架,降低企业导入门槛。

业界反应:开源阵营持续加码

在多数头部厂商转向闭源订阅制之际,Mistral持续以Apache 2.0全面开源作为竞争策略,延续自2023年成立以来的一贯路线,让企业多了「大模型能力+可自主部署、不受单一云服务绑定」的选择。

对管理者的意义

对评估AI导入方案的管理者而言,这次发布的关键信息是:企业若因数据敏感度或成本考量不愿采用云端API,现在有更成熟的开源本地部署选项——尤其是Ministral系列小模型,适合部署在门店、工厂现场等对延迟和隐私要求较高的场景,值得IT部门列入评估清单。

测验检核:验证你的理解
5 篇 · 答对 80% 通过,通过后计入学习履历 登录后即可测验
问 AI:这篇文章怎么用在我的管理上?
内容由 AI 根据本文辅助生成,仅供参考,请自行判断准确性。
下一讲・AI 管理编年史 Google DeepMind发布新版Gemini Deep Research智能体,通过Interactions API开放企业接入

相关文章

我们使用必要 Cookie 维持登录与语言设置,并记录使用行为以改善服务。你可以只保留必要项目。 隐私权政策