專欄 AI 管理編年史 第 92/217 講 查看課程目錄

Mistral AI 發表 Mistral Small 3.1:240億參數開放模型正面叫陣GPT-4o Mini

17/03/2025 256
3:19
Mistral AI 發表 Mistral Small 3.1:240億參數開放模型正面叫陣GPT-4o Mini

Mistral AI於2025年3月17日發表開放權重模型Mistral Small 3.1,240億參數、支援文字與圖像的多模態能力,上下文長度最高12.8萬token,並以Apache 2.0授權開放下載,官方宣稱效能超越Gemma 3與GPT-4o Mini。

法國AI新創Mistral AI於2025年3月17日發表最新模型Mistral Small 3.1,這是一款擁有240億參數的開放權重模型。與先前版本最大的不同,是這次新增了完整的多模態能力——模型不只能處理文字,也能理解與分析圖像輸入,同時具備多語言理解能力。上下文處理長度最高可達12.8萬token,足以一次讀入長篇文件或大量對話紀錄。官方數據顯示,推論速度可達每秒150個token。

模型分為Base版與Instruct版兩種,皆以Apache 2.0授權釋出,任何人都能在Hugging Face平台免費下載、微調甚至商業使用,沒有授權限制。這是Mistral AI一貫的開放策略延續——相較於OpenAI、Anthropic等公司多以封閉API形式提供服務,Mistral持續選擇把模型權重直接公開。

技術意義:同量級開放模型追上專有模型效能

Mistral Small 3.1最受關注的地方,在於官方直接把自己與Google的Gemma 3、OpenAI的GPT-4o Mini,以及Anthropic的Claude 3.5 Haiku放在同一張效能比較表上,並宣稱在多項基準測試中超越這些競品。這代表「開放權重」與「專有API」之間的效能差距正在快速縮小——過去外界普遍認為,想要接近GPT級別的表現,只能透過付費API取得,但像Mistral Small 3.1這樣的開放模型,正在證明240億參數等級的模型也能做到接近甚至超越同量級專有模型的水準。

與前代比較:多模態是關鍵補強

相較於Mistral先前的Small系列版本,3.1版本最大的躍進是補上了圖像理解能力,讓開放模型陣營在多模態這塊不再明顯落後於OpenAI、Google等公司的旗艦產品。搭配12.8萬token的長上下文,使得這款模型可以同時處理「看圖+讀長文」的複合任務,應用範圍明顯擴大。

業界反應:開放模型陣營持續逼近護城河

此次發表被視為開放權重模型陣營持續蠶食專有模型市場的又一例證。企業與開發者若採用Mistral Small 3.1,可以在自有伺服器上部署、不受API呼叫次數與資料外流疑慮限制,同時仍能取得接近主流專有小型模型的效能表現,這對重視資料主權與成本控制的組織而言是一項實質誘因。

對管理者而言,這則新聞的意義在於:AI模型的選擇權正在擴大。若企業因資料保密或成本考量而不便使用外部AI API,現在已有效能不錯的開放模型可以自行部署,值得請IT或技術團隊評估是否適合導入內部系統。

測驗檢核:驗證你的理解
5 篇 · 答對 80% 通過,通過後計入學習履歷 登入後即可測驗
問 AI:這篇文章怎麼用在我的管理上?
內容由 AI 根據本文輔助生成,僅供參考,請自行判斷準確性。
下一講・AI 管理編年史 NVIDIA發表Dynamo:開源AI推理作業系統,目標降低企業運算成本

相關文章

我們使用必要 Cookie 維持登入與語言設定,並記錄使用行為以改善服務。你可以只保留必要項目。 隱私權政策