专栏 AI 管理编年史 第 52/217 讲 查看课程目录

Mistral AI携手NVIDIA发布开源模型Mistral NeMo 12B

18/07/2024 147
3:20
Mistral AI携手NVIDIA发布开源模型Mistral NeMo 12B

Mistral AI与NVIDIA联合发布120亿参数开源模型Mistral NeMo,支持128K上下文窗口,采用Apache 2.0许可证发布,并搭载全新多语言分词器Tekken。

2024年7月18日,法国AI初创公司Mistral AI与NVIDIA共同发布最新开源大语言模型「Mistral NeMo」,参数规模120亿(12B)。官方宣称在同尺寸模型中,Mistral NeMo的推理能力、世界知识与代码准确度均达到业界顶尖水平。模型支持最长128,000 token的上下文窗口,可一次处理长篇文档、大型代码库或长时间对话记录。Mistral AI同时发布该模型的预训练基础版(base)与指令微调版(instruct),两者均采用Apache 2.0许可证,允许研究者与企业自由下载、修改与商用,不受限制条款约束。

值得注意的是,Mistral NeMo搭配一款全新分词器(tokenizer)「Tekken」,以Tiktoken为基础打造,训练数据涵盖超过100种语言,官方表示其对多语言文本与代码的压缩效率优于前代分词器,尤其在非英语语种(如中文、韩文、阿拉伯文、印地语系)上表现更佳。

技术意义:与NVIDIA深度合作的信号

此次发布由Mistral AI与NVIDIA联合署名,属于NVIDIA近年积极布局「开源模型生态系统」的一环——NVIDIA提供算力基础设施与模型优化(包含针对NVIDIA GPU的推理加速),Mistral AI则贡献模型架构与训练数据。128K的上下文窗口在12B这个「中小尺寸」模型上并不常见,意味着企业无需选择数百亿参数以上的巨型模型,也能获得长文本处理能力,大幅降低部署与推理成本。

与同尺寸模型的对比

12B参数属于「可在单张高端GPU上部署」的甜蜜点——比起同期其他开源模型,Mistral NeMo以更大的上下文窗口与新分词器作为差异化卖点。而Apache 2.0许可证(相较部分同业采用较多限制条款的许可证)也让企业在商用部署时法务合规顾虑更低,是Mistral NeMo被视为「对企业友好」的关键原因之一。

业界反应

开源社区对Tekken分词器的多语言压缩效率评价正面,开发者社区迅速将模型上架供下载测试;同时也有评论指出,这是Mistral AI在数月前接受战略投资后,与NVIDIA合作具体落地的首个公开产品,被视为初创公司与科技巨头合作模式的观察指标。

对管理者而言,Mistral NeMo这类「可自行部署、许可宽松」的开源模型,意味着企业若对数据隐私或定制化有特殊需求(例如不希望客户对话数据上传至第三方云端),现在多了一个可自建、可微调的选项,而非只能依赖付费API。管理者可请IT或数据团队评估:公司内部是否有适合用开源模型自建的场景(如客服知识库问答、内部文档摘要),以降低长期AI落地的边际成本。

测验检核:验证你的理解
5 篇 · 答对 80% 通过,通过后计入学习履历 登录后即可测验
问 AI:这篇文章怎么用在我的管理上?
内容由 AI 根据本文辅助生成,仅供参考,请自行判断准确性。
下一讲・AI 管理编年史 Meta发布Llama 3.1 405B:号称首个对标顶级闭源模型的开源模型

相关文章

我们使用必要 Cookie 维持登录与语言设置,并记录使用行为以改善服务。你可以只保留必要项目。 隐私权政策