Mistral AI携手NVIDIA发布开源模型Mistral NeMo 12B
Mistral AI与NVIDIA联合发布120亿参数开源模型Mistral NeMo,支持128K上下文窗口,采用Apache 2.0许可证发布,并搭载全新多语言分词器Tekken。
2024年7月18日,法国AI初创公司Mistral AI与NVIDIA共同发布最新开源大语言模型「Mistral NeMo」,参数规模120亿(12B)。官方宣称在同尺寸模型中,Mistral NeMo的推理能力、世界知识与代码准确度均达到业界顶尖水平。模型支持最长128,000 token的上下文窗口,可一次处理长篇文档、大型代码库或长时间对话记录。Mistral AI同时发布该模型的预训练基础版(base)与指令微调版(instruct),两者均采用Apache 2.0许可证,允许研究者与企业自由下载、修改与商用,不受限制条款约束。
值得注意的是,Mistral NeMo搭配一款全新分词器(tokenizer)「Tekken」,以Tiktoken为基础打造,训练数据涵盖超过100种语言,官方表示其对多语言文本与代码的压缩效率优于前代分词器,尤其在非英语语种(如中文、韩文、阿拉伯文、印地语系)上表现更佳。
技术意义:与NVIDIA深度合作的信号
此次发布由Mistral AI与NVIDIA联合署名,属于NVIDIA近年积极布局「开源模型生态系统」的一环——NVIDIA提供算力基础设施与模型优化(包含针对NVIDIA GPU的推理加速),Mistral AI则贡献模型架构与训练数据。128K的上下文窗口在12B这个「中小尺寸」模型上并不常见,意味着企业无需选择数百亿参数以上的巨型模型,也能获得长文本处理能力,大幅降低部署与推理成本。
与同尺寸模型的对比
12B参数属于「可在单张高端GPU上部署」的甜蜜点——比起同期其他开源模型,Mistral NeMo以更大的上下文窗口与新分词器作为差异化卖点。而Apache 2.0许可证(相较部分同业采用较多限制条款的许可证)也让企业在商用部署时法务合规顾虑更低,是Mistral NeMo被视为「对企业友好」的关键原因之一。
业界反应
开源社区对Tekken分词器的多语言压缩效率评价正面,开发者社区迅速将模型上架供下载测试;同时也有评论指出,这是Mistral AI在数月前接受战略投资后,与NVIDIA合作具体落地的首个公开产品,被视为初创公司与科技巨头合作模式的观察指标。
对管理者而言,Mistral NeMo这类「可自行部署、许可宽松」的开源模型,意味着企业若对数据隐私或定制化有特殊需求(例如不希望客户对话数据上传至第三方云端),现在多了一个可自建、可微调的选项,而非只能依赖付费API。管理者可请IT或数据团队评估:公司内部是否有适合用开源模型自建的场景(如客服知识库问答、内部文档摘要),以降低长期AI落地的边际成本。