DeepSeek 發表 DeepSeek-V3-0324:後訓練優化版本,數學程式碼評測超越 GPT-4.5
DeepSeek 於 2025 年 3 月 24 日發表 DeepSeek-V3-0324,沿用原架構但強化後訓練流程,推理、程式撰寫與工具使用能力提升,並改採 MIT 授權開源。
DeepSeek 於 2025 年 3 月 24 日發表 DeepSeek-V3-0324,這是原始 DeepSeek-V3 模型的改良版本。官方說明指出,新版本沿用與前代相同的基礎模型架構,並未重新訓練整個模型,而是把重點放在「後訓練(post-training)」流程的優化上,借鏡了 DeepSeek 自家推理模型 R1 在強化學習上的技術經驗。這種「架構不變、後訓練加強」的做法,讓 DeepSeek 得以用相對較低的成本快速迭代出效能更好的版本。
DeepSeek-V3-0324 支援 12.8 萬 token 的長上下文視窗,可處理長文件分析、書籍摘要、大型程式碼庫理解等需要一次讀進大量內容的任務。官方公布的評測數據顯示,此版本在數學與程式碼相關的評測項目上,表現甚至超越了 OpenAI 同期發布的 GPT-4.5。另一個值得注意的變化是授權方式:DeepSeek 將此版本的授權從先前的自訂開源授權,改為業界更廣泛採用的 MIT 授權,降低了企業與開發者在商用時的法律疑慮與整合門檻。
後訓練優化為何值得關注
相較於直接推出參數更大、重新訓練的新一代模型,DeepSeek 選擇在既有 V3 架構上,透過強化學習等後訓練技術「調校」模型行為,讓推理、程式撰寫、工具使用(tool use)等能力同步提升。這代表模型能力的進步,不一定要靠更大規模的訓練成本堆出來,後訓練環節本身就可以是效能提升的關鍵槓桿,也解釋了為何 DeepSeek 能在短時間內接連推出更新版本。
與 GPT-4.5 的評測比較釋放的訊號
官方數據顯示 DeepSeek-V3-0324 在數學與程式碼評測上超越 GPT-4.5,這個對比之所以受到關注,是因為 GPT-4.5 是 OpenAI 才在同月稍早(2025 年 2 月底)發布的研究預覽版模型。一個開源、且改採寬鬆 MIT 授權的模型,在特定評測項目上能與封閉模型的最新成果相抗衡甚至超前,反映出開源陣營在追趕頂尖封閉模型的速度上並未落後太多,也讓「開源模型只能當備胎」的既定印象受到挑戰。
MIT 授權轉換的實務意義
授權從自訂條款改為 MIT 授權,是這次更新中容易被忽略、但對企業使用者影響最直接的變化。MIT 授權是業界最寬鬆、最普遍被企業法務接受的開源授權之一,允許自由使用、修改、商用甚至再授權,只需保留原始授權聲明。這代表企業若要將 DeepSeek-V3-0324 導入內部系統、二次開發或商業化部署,法律審查的複雜度會明顯降低,這對評估導入開源模型的企業 IT 與法務團隊來說,是實務上的一大助益。
對管理者而言,這則新聞的意義不在於追逐某一款模型的排行榜名次,而是提醒:AI 模型的進步速度與授權條件都在快速變動,長上下文與程式理解能力的提升,代表交給 AI 處理長合約、長報告或程式碼審查的可行性又往前一步,值得留意這類工具是否已能實際減輕團隊的文書與技術負擔。