DeepSeek發表開源推理模型R1,效能追平OpenAI o1、NVIDIA股價應聲重挫
中國AI新創DeepSeek發表開源推理模型DeepSeek-R1,採MIT授權開放權重免費商用,技術報告顯示推理能力可與OpenAI o1匹敵甚至部分超越,但訓練成本遠低於西方競品,消息發布一週後DeepSeek App衝上美國App Store免費榜冠軍,並牽動NVIDIA股價單日重挫近18%。
2025年1月20日,中國AI新創公司DeepSeek正式發表開源推理模型DeepSeek-R1,並同步在官方管道公開模型權重,採用MIT授權,允許任何人免費用於商業與學術用途。這是繼DeepSeek-V3之後,該公司再次以「開源+低成本」的策略衝擊市場。
根據DeepSeek公布的技術報告,R1在多項推理能力基準測試(涵蓋數學、程式撰寫、邏輯推理等任務)上的表現,可與OpenAI於2024年底推出的o1模型相匹敵,部分測試項目甚至超越o1。更受矚目的是,DeepSeek宣稱其訓練與運算成本遠低於西方主要競品,這打破了「頂尖推理模型必須靠鉅額運算資源堆疊」的既定認知。
技術意義:開源權重+低成本,改寫推理模型的門檻
過去一年,「推理模型」(reasoning model,如OpenAI o1系列)被視為AI下一階段的技術制高點,普遍認為需要龐大的運算資源與訓練預算才能達成高水準表現。DeepSeek-R1的發布提出了不同的路徑:透過更有效率的訓練方法,用相對低廉的成本做出可比擬水準的推理能力,同時選擇開源釋出權重,而非像OpenAI o1那樣僅提供API存取。這意味著開發者與企業能直接取得模型本體進行部署、微調與研究,門檻大幅降低。
與競品比較:從「閉源領先」到「開源追平」
在此之前,市場普遍認為OpenAI、Anthropic等西方業者在最先進的推理能力上握有明顯領先,且多以閉源API形式提供服務。DeepSeek-R1的出現,讓「開源模型是否落後閉源模型一個世代」的說法首次在推理能力這個最前沿的項目上受到挑戰。這也呼應了此前DeepSeek-V3以低成本訓練出接近一線水準基礎模型的路線,顯示這家公司在「效率優先」的技術策略上具有延續性。
業界反應:App Store衝榜與NVIDIA股價重挫
消息發布後市場反應相當劇烈。發布約一週後,DeepSeek App登上美國iOS商店免費榜冠軍,超越ChatGPT,顯示一般消費者對這款來自中國、免費且效能不遜色的AI應用的高度好奇與採用意願。更值得管理者關注的是資本市場的連鎖反應:由於R1證明高水準推理模型可以用遠低於預期的運算資源訓練完成,市場重新評估了整個AI產業對晶片與算力的需求規模,NVIDIA股價單日重挫約18%,反映出投資人對「AI算力軍備競賽」假設的動搖。
對管理者的意義
這則新聞提醒管理者,AI技術的競爭優勢不再只取決於誰砸的錢與運算資源最多,效率與成本控制同樣可能成為決定性變數;同時,開源模型的普及意味著企業導入高階AI能力(例如複雜推理、決策輔助)的成本門檻正快速下降,值得重新評估內部AI導入的時程與預算規劃,而非假設先進AI能力永遠只掌握在少數大廠手中。