NVIDIA NeMo微服務平台正式全面開放,企業打造專屬AI代理有了現成積木
NVIDIA宣布NeMo微服務平台正式全面開放(GA),企業可用模組化工具客製生成式AI模型與AI代理,Accenture、Deloitte、EY、Siemens等已導入製造、資安、軟體開發等場景。
NVIDIA於2025年4月23日宣布,旗下NeMo(neural module)微服務平台正式全面開放(General Availability,簡稱GA)。這套平台不是單一模型,而是一整套「模組化積木」——企業可用它建置、客製並部署生成式AI模型與AI代理,並直接與多個合作夥伴平台整合,不必從零打造整套AI基礎設施。核心功能有三項:提示詞調校(prompt tuning)、監督式微調(supervised fine-tuning,SFT)、知識檢索工具(串接企業內部資料)。三者合起來,等於把「訓練一個懂公司業務的AI」所需步驟包裝成可直接呼叫的服務,省去企業自建訓練管線的工程負擔。
技術意義:從「用模型」到「調模型」
過去多數企業使用生成式AI,做法是直接呼叫現成大型模型API,頂多加一層提示詞工程。NeMo微服務把「微調」平台化,代表NVIDIA想切入「直接用通用模型」與「自己從頭訓練模型」之間的客製化中間層。這降低了打造專屬AI代理的技術門檻,也代表AI導入重心正從「選哪個模型」轉向「怎麼把模型調教成懂自己產業」。
早期採用名單透露的訊號
NVIDIA公布的早期採用企業涵蓋顧問業(Accenture、Deloitte、EY)、晶片設計軟體(Cadence、Synopsys)、資安(CrowdStrike)、軟體開發工具(Cursor)、雲端基礎設施(OCI)、資料分析(Palantir)、搜尋(Perplexity)、企業服務流程(ServiceNow)、工業自動化(Siemens)及通訊協作(Zoom)。共通點是這些產業「流程高度標準化、卻需要大量客製化知識」,正是微調型AI代理最容易發揮價值的場景。
業界反應:平台化競賽的一步
NeMo GA上線時間點落在Meta Llama 4、OpenAI GPT-4.1系列相繼發布之後,顯示晶片與雲端廠商正加速卡位「模型之上的一層」——企業真正要落地的工具鏈,而非模型本身的競賽。這呼應了業界趨勢:企業導入AI真正卡關之處,往往是「怎麼把通用模型變成懂自己公司」的最後一哩路。對管理者而言,啟示不在於是否採用NVIDIA平台,而在於留意AI代理客製化門檻正快速降低——公司內部高度依賴內部知識、卻又流程標準化的工作(如客服應答、內部規章查詢、標準作業流程指引),值得評估導入類似的客製化AI代理。