DeepSeek 官宣 V4 正式版 7 月中旬上線:1M 上下文全線標配,首度實施尖峰分時定價
DeepSeek 於 2026 年 6 月 29 日官宣 V4 正式版將於 7 月中旬上線,推出 pro 與 flash 兩款模型,全線標配 100 萬 token 上下文視窗,並首度實施尖峰/離峰分時 API 定價:北京時間尖峰時段收費為現行價的 2 倍、離峰維持不變;舊別名將於 7 月 24 日退役。
中國 AI 公司 DeepSeek 於 2026 年 6 月 29 日正式官宣:V4 正式版將於 7 月中旬上線,同步推出兩款模型——旗艦級 deepseek-v4-pro,總參數 1.6 兆(1.6T)、每次推理啟用 490 億(49B);輕量級 deepseek-v4-flash,總參數 2,840 億(284B)、啟用 130 億(13B)。兩款模型全線標配 100 萬 token 上下文視窗,官方並預告推理計算量僅為前代 V3.2 的 27%,較 4 月 24 日的 preview 版在代理任務執行、數學推理與程式生成上進一步強化。
技術意義:1M 上下文從旗艦特權變成全線標配
過去百萬 token 級的上下文多半是各家旗艦模型的專屬賣點,DeepSeek 這次連輕量的 flash 也給足 1M,意味著整份合約審閱、長文件分析、程式碼庫級理解,用低價模型就能完成。API 同時支援 OpenAI ChatCompletions 與 Anthropic 介面,base_url 不變、只需改 model 參數,遷移成本壓到最低——這是對兩大生態系開發者的直接招手。
首度實施尖峰分時定價:AI 算力進入「電價邏輯」
本次公告最受矚目的商業設計,是 DeepSeek 首度實施尖峰/離峰分時 API 定價:每日北京時間 9:00–12:00 與 14:00–18:00(泰國時間 8:00–11:00 與 13:00–17:00)為尖峰時段,收費為離峰的 2 倍;離峰時段則維持現行定價不變。這等於把電網的分時電價思維搬進 AI 算力市場,一方面鼓勵批次任務移往夜間與離峰執行,另一方面也透露推理算力供給仍是產業瓶頸。
舊別名倒數退役:7 月 24 日是遷移死線
官方同步提醒,legacy 別名 deepseek-chat 與 deepseek-reasoner 將於 2026 年 7 月 24 日 15:59(UTC)全面退役,並建議在正式版上線後、7 月 15 日前後完成遷移測試。仍在使用舊別名的系統,必須趕在死線前改用新的 model 名稱,否則將面臨服務中斷。
對管理者而言,這則新聞的啟示有二:一是 1M 上下文平價化後,「整批文件直接丟給 AI」正式成為可行的日常工作方式;二是分時定價提醒我們,AI 用量開始像水電一樣需要排程管理——把報表生成、資料整理等非即時任務排到離峰時段執行,API 成本就能比尖峰省下一半。