DeepSeek 官宣 V4 正式版 7 月中旬上线:1M 上下文全线标配,首次实施峰谷分时定价
DeepSeek 于 2026 年 6 月 29 日官宣 V4 正式版将于 7 月中旬上线,推出 pro 与 flash 两款模型,全线标配 100 万 token 上下文窗口,并首次实施峰谷分时 API 定价:北京时间高峰时段收费为现行价的 2 倍、低谷维持不变;旧别名将于 7 月 24 日退役。
中国 AI 公司 DeepSeek 于 2026 年 6 月 29 日正式官宣:V4 正式版将于 7 月中旬上线,同步推出两款模型——旗舰级 deepseek-v4-pro,总参数 1.6 万亿(1.6T)、每次推理激活 490 亿(49B);轻量级 deepseek-v4-flash,总参数 2840 亿(284B)、激活 130 亿(13B)。两款模型全线标配 100 万 token 上下文窗口,官方并预告推理计算量仅为前代 V3.2 的 27%,较 4 月 24 日的 preview 版在智能体任务执行、数学推理与代码生成上进一步强化。
技术意义:1M 上下文从旗舰特权变成全线标配
过去百万 token 级的上下文多半是各家旗舰模型的专属卖点,DeepSeek 这次连轻量的 flash 也给足 1M,意味着整份合同审阅、长文档分析、代码库级理解,用低价模型就能完成。API 同时支持 OpenAI ChatCompletions 与 Anthropic 接口,base_url 不变、只需改 model 参数,迁移成本压到最低——这是对两大生态开发者的直接招手。
首次实施峰谷分时定价:AI 算力进入「电价逻辑」
本次公告最受瞩目的商业设计,是 DeepSeek 首次实施峰谷分时 API 定价:每日北京时间 9:00–12:00 与 14:00–18:00(泰国时间 8:00–11:00 与 13:00–17:00)为高峰时段,收费为低谷的 2 倍;低谷时段则维持现行定价不变。这等于把电网的分时电价思维搬进 AI 算力市场,一方面鼓励批量任务转移到夜间与低谷执行,另一方面也透露推理算力供给仍是行业瓶颈。
旧别名倒计时退役:7 月 24 日是迁移死线
官方同步提醒,legacy 别名 deepseek-chat 与 deepseek-reasoner 将于 2026 年 7 月 24 日 15:59(UTC)全面退役,并建议在正式版上线后、7 月 15 日前后完成迁移测试。仍在使用旧别名的系统,必须赶在死线前改用新的 model 名称,否则将面临服务中断。
对管理者而言,这则新闻的启示有二:一是 1M 上下文平价化后,「整批文件直接丢给 AI」正式成为可行的日常工作方式;二是分时定价提醒我们,AI 用量开始像水电一样需要排程管理——把报表生成、数据整理等非实时任务安排到低谷时段执行,API 成本就能比高峰省下一半。