專欄 AI 管理編年史 第 93/217 講 查看課程目錄

NVIDIA發表Dynamo:開源AI推理作業系統,目標降低企業運算成本

18/03/2025 207
3:29
NVIDIA發表Dynamo:開源AI推理作業系統,目標降低企業運算成本

NVIDIA執行長黃仁勳在GTC 2025主題演講發表開源AI推理作業系統Dynamo,同場公布Blackwell架構全面量產、效能達前代40倍,並預告Blackwell Ultra與Rubin GPU規格,凸顯AI推理與代理式AI需求正快速拉動運算需求。

NVIDIA執行長黃仁勳於2025年3月18日在GTC 2025主題演講中,發表了一款名為Dynamo的開源AI推理(inference)作業系統軟體。Dynamo的定位不是硬體,而是一層運算管理軟體,讓企業在NVIDIA GPU叢集上運行大型語言模型時,能提升處理量(throughput)、同時降低單位推理成本。同場演講中,黃仁勳也正式公布Blackwell架構已全面量產出貨,效能達前代Hopper架構的40倍,並提前預告下半年將推出的次世代Blackwell Ultra,以及規劃於2026年問世的Rubin GPU規格。

為什麼是「推理作業系統」,不是新晶片

過去兩年,業界討論AI運算多聚焦在訓練(training)大型模型需要多強的晶片。但隨著愈來愈多企業已經訓練好模型、進入「天天呼叫、大量呼叫」的推理階段,真正燒錢的環節轉移到推理端:同一顆GPU,如何在同時服務更多使用者請求時不掉速、不浪費算力。Dynamo正是針對這個痛點而生——它像是資料中心層級的排程與資源調度系統,把GPU叢集的推理任務做更聰明的分配,理論上讓相同硬體投資能撐起更高的服務量。NVIDIA選擇將其開源,也是延續近年釋出CUDA周邊生態工具、鞏固開發者黏著度的一貫策略。

與前代相比:40倍效能提升代表什麼

Blackwell架構相較Hopper架構效能達40倍,這個數字放在兩年一世代的GPU演進速度中屬於異常陡峭的成長曲線,反映的正是市場對生成式AI與「代理式AI」(agentic AI,能自主規劃、呼叫工具、多步驟執行任務的AI系統)運算需求的爆發性成長。同時預告的Blackwell Ultra(今年下半年)與Rubin(2026年),顯示NVIDIA把產品路線圖提前攤在陽光下,讓資料中心業者、雲端服務商能提前規劃採購與資本支出,也等於向市場宣示其晶片領先地位短期內不會被追上。

業界反應:算力軍備賽從訓練轉向推理

此次GTC演講釋出的訊號很清楚:接下來的AI競爭,重心會從「誰能訓練出更強的模型」逐漸轉移到「誰能用更低成本、更大規模地把模型服務給終端使用者」。這也解釋了為什麼NVIDIA要親自下場做推理層軟體,而非只賣晶片——當推理成本成為企業導入AI應用的最大變數,掌握「效率」這個環節,比單純賣算力更能鎖定長期客戶關係。

對管理者的意義

對多數企業管理者而言,不必自己懂GPU排程細節,但值得記住一個訊號:AI導入成本正在快速下降,過去因為「跑一次AI很貴」而擱置的專案(例如即時客服、大量文件分析、供應鏈預測),未來一到兩年內的可行性會明顯提升,適合列入年度數位轉型評估清單重新檢視。

測驗檢核:驗證你的理解
5 篇 · 答對 80% 通過,通過後計入學習履歷 登入後即可測驗
問 AI:這篇文章怎麼用在我的管理上?
內容由 AI 根據本文輔助生成,僅供參考,請自行判斷準確性。
下一講・AI 管理編年史 xAI 為 Grok 3 新增 DeeperSearch 深度搜尋與圖片編輯功能

相關文章

我們使用必要 Cookie 維持登入與語言設定,並記錄使用行為以改善服務。你可以只保留必要項目。 隱私權政策