专栏 AI 管理编年史 第 93/217 讲 查看课程目录

NVIDIA发布Dynamo:开源AI推理操作系统,目标降低企业运算成本

18/03/2025 209
3:29
NVIDIA发布Dynamo:开源AI推理操作系统,目标降低企业运算成本

NVIDIA首席执行官黄仁勋在GTC 2025主题演讲发布开源AI推理操作系统Dynamo,同场公布Blackwell架构全面量产、性能达上代40倍,并预告Blackwell Ultra与Rubin GPU规格,凸显AI推理与智能体AI需求正快速拉动运算需求。

NVIDIA首席执行官黄仁勋于2025年3月18日在GTC 2025主题演讲中,发布了一款名为Dynamo的开源AI推理(inference)操作系统软件。Dynamo的定位不是硬件,而是一层运算管理软件,让企业在NVIDIA GPU集群上运行大语言模型时,能提升吞吐量(throughput)、同时降低单位推理成本。同场演讲中,黄仁勋也正式公布Blackwell架构已全面量产出货,性能达上代Hopper架构的40倍,并提前预告下半年将推出的下一代Blackwell Ultra,以及规划于2026年问世的Rubin GPU规格。

为什么是「推理操作系统」,而不是新芯片

过去两年,业界讨论AI运算多聚焦在训练(training)大模型需要多强的芯片。但随着越来越多企业已经训练好模型、进入「天天调用、大量调用」的推理阶段,真正烧钱的环节转移到推理端:同一颗GPU,如何在同时服务更多用户请求时不掉速、不浪费算力。Dynamo正是针对这个痛点而生——它像是数据中心层级的调度与资源分配系统,把GPU集群的推理任务做更智能的分配,理论上让相同硬件投资能支撑更高的服务量。NVIDIA选择将其开源,也是延续近年释出CUDA周边生态工具、巩固开发者黏性的一贯策略。

与上代相比:40倍性能提升意味着什么

Blackwell架构相较Hopper架构性能达40倍,这个数字放在两年一代的GPU演进速度中属于异常陡峭的增长曲线,反映的正是市场对生成式AI与「智能体AI」(agentic AI,能自主规划、调用工具、多步骤执行任务的AI系统)运算需求的爆发性增长。同时预告的Blackwell Ultra(今年下半年)与Rubin(2026年),显示NVIDIA把产品路线图提前公开,让数据中心厂商、云服务商能提前规划采购与资本支出,也等于向市场宣示其芯片领先地位短期内不会被追上。

业界反应:算力军备赛从训练转向推理

此次GTC演讲释出的信号很清楚:接下来的AI竞争,重心会从「谁能训练出更强的模型」逐渐转移到「谁能用更低成本、更大规模地把模型服务给终端用户」。这也解释了为什么NVIDIA要亲自下场做推理层软件,而非只卖芯片——当推理成本成为企业导入AI应用的最大变量,掌握「效率」这个环节,比单纯卖算力更能锁定长期客户关系。

对管理者的意义

对多数企业管理者而言,不必自己懂GPU调度细节,但值得记住一个信号:AI导入成本正在快速下降,过去因为「跑一次AI很贵」而搁置的项目(例如实时客服、大量文档分析、供应链预测),未来一到两年内的可行性会明显提升,适合列入年度数字化转型评估清单重新审视。

测验检核:验证你的理解
5 篇 · 答对 80% 通过,通过后计入学习履历 登录后即可测验
问 AI:这篇文章怎么用在我的管理上?
内容由 AI 根据本文辅助生成,仅供参考,请自行判断准确性。
下一讲・AI 管理编年史 xAI为Grok 3新增DeeperSearch深度搜索与图片编辑功能

相关文章

我们使用必要 Cookie 维持登录与语言设置,并记录使用行为以改善服务。你可以只保留必要项目。 隐私权政策