DeepSeek发布V4-Pro与V4-Flash预览版:万亿级参数、百万token上下文,全面开源
DeepSeek于2026年4月24日发布V4-Pro与V4-Flash两款新模型预览版。V4-Pro总参数达1.6万亿、激活参数490亿;V4-Flash总参数2840亿、激活参数130亿,二者均支持百万token上下文,并以MIT协议全面开源。
2026年4月24日,中国AI公司DeepSeek发布两款新一代语言模型的预览版:V4-Pro与V4-Flash。V4-Pro采用混合专家(MoE)架构,总参数规模达1.6万亿,但每次推理仅激活约490亿参数;体积较小的V4-Flash总参数为2840亿,激活参数130亿。两款模型均支持百万token量级的上下文窗口,并延续DeepSeek一贯做法,以MIT协议完整开源权重,任何企业或开发者都可自由下载、微调、商用,不受授权费用限制。
技术意义:低激活参数换取推理效率
V4-Pro“1.6万亿总参数、仅490亿激活”的设计,意味着激活参数占比仅约3%,是目前公开模型中比例最低的架构之一。这种极致稀疏化的MoE设计,让模型在保有庞大知识容量的同时,实际运算成本与一般中型模型相近,这是DeepSeek自V3以来持续强化的技术路线,目标是用更低的硬件门槛跑出更强的能力。百万token上下文则让模型能一次处理长文档、整份合同或大型代码库,无需额外的检索或分段技术。
与前代及竞品的比较
相较于前代V3系列,V4-Pro的总参数规模明显放大,但通过更低的激活参数比例控制了推理成本,走的是“更大脑容量、更省算力”的路线,与OpenAI、Anthropic等主要走闭源订阅制的做法形成对比。V4-Flash则瞄准需要更快响应速度与更低成本的应用场景,总参数规模不到V4-Pro的五分之一,属于同系列中的轻量版本,二者搭配可覆盖从实时客服到深度分析的不同需求层级。
业界反应
开源社区普遍关注的重点在于:MIT协议意味着企业可将模型完全私有化部署,不必担心数据外流或授权费按字计价的问题,这对成本敏感、又重视数据主权的地区(如东南亚企业)具有吸引力。也有评论指出,万亿级参数模型虽然开源,但实际自建推理基础设施的门槛仍高,多数中小企业仍需依赖云服务商托管部署版本。
对管理者的意义
对管理者而言,这则新闻的重点不在于“又出了一个新模型”,而在于开源大模型的性价比持续逼近甚至超越封闭模型——若企业正在评估是否要自建AI客服、内部知识库或编程辅助工具,V4-Flash这类轻量开源模型值得列入采购评估清单,因为授权成本趋近于零,只剩下算力与运维的取舍。