Mistral 發表 OCR 4:文件智慧模型支援 170 種語言、可私有部署
法國 AI 新創 Mistral AI 於 2026 年 6 月 23 日發表新一代文件智慧模型 Mistral OCR 4,支援 170 種語言辨識、可部署於企業自有基礎設施,並新增段落級文字定位框功能。
2026 年 6 月 23 日,法國 AI 新創 Mistral AI 發表新一代文件智慧模型「Mistral OCR 4」。這款模型的核心賣點有三:支援 170 種語言的文字辨識、可部署於企業自有基礎設施(on-premise/私有雲),以及新增「段落級文字定位框」功能,也就是模型輸出結果時,不只給出辨識出的文字,還會標出每一段文字在原始文件影像中的精確座標位置。
技術亮點:辨識之外,還要「定位」
傳統 OCR(光學文字辨識)工具的任務相對單純:把掃描或拍照的文件轉成可編輯、可搜尋的文字。但 Mistral OCR 4 更進一步,輸出結果附帶段落級的 bounding box(定位框),意味著下游系統可以精確知道「這段文字來自文件的哪個位置」。這對需要把辨識結果對應回原始版面的應用非常關鍵,例如合約審閱時需要標註特定條款所在頁面與段落、或是發票辨識需要精準框出金額欄位以利後續稽核比對。170 種語言的支援範圍,也讓這款模型在處理多語系、跨國文件(例如東協區域常見的泰、英、中、緬等混合語言文件)時具備明顯優勢。
可私有部署:企業資料主權的關鍵差異
Mistral OCR 4 另一項受到關注的特性,是可部署於企業自有基礎設施,而非僅透過雲端 API 呼叫。這意味著金融、醫療、政府等對資料外流高度敏感的產業,可以在自己的機房或私有雲環境中運行模型,文件內容不需經過第三方伺服器。這與多數主流 OCR/文件 AI 服務仍以雲端 SaaS 為主的做法形成對比,也呼應了 Mistral 一貫以「開放權重、可自架」作為市場區隔的策略路線。
業界反應:文件 AI 賽道持續升溫
文件智慧(Document Intelligence)近年已成為企業 AI 落地最務實的場景之一,從發票、合約、報關單到工地圖說,都涉及大量非結構化紙本或掃描檔轉換為結構化資料的需求。Mistral 此次發表被業界視為對這塊市場的正面表態,也顯示除了 Google、Amazon、Microsoft 等雲端巨頭的文件 AI 服務外,開放權重陣營同樣有能力提供具備企業級精度與部署彈性的方案,為採購方增加了議價與選擇空間。
對管理者而言,這則新聞的重點不在於「又出了一個新模型」,而在於文件處理這件企業裡最耗人力的瑣碎工作,正逐漸出現「可自行掌控資料、又能對應複雜版面」的選項。若貴公司每天要處理大量多語言單據(發票、合約、報關文件),這類具定位框與私有部署能力的模型,值得列入下一輪流程數位化的評估清單。