DeepSeek V4-Flash 正式版 API 上线公测:后训练驱动的 Agent 能力跃迁
2026 年 7 月 31 日,DeepSeek 上线 V4-Flash-0731 正式版 API:架构不变、仅靠后训练,Agent 能力大幅超越 V4-Pro 预览版,并原生支持 Responses API、适配 Codex。
2026 年 7 月 31 日,DeepSeek 通过 API 文档更新日志宣布 DeepSeek-V4-Flash 正式版 API 上线公测(内部代号 V4-Flash-0731)。模型结构与参数规模与预览版完全一致,仅重新进行了后训练与对齐优化,Agent 能力大幅跃升:Terminal Bench 2.1 达 82.7,DeepSWE 从预览版的 7.3 飙升至 54.4。
架构不变,能力全部来自后训练
- 总参 284B、激活 13B 的 MoE 架构、原生 100 万 token 上下文,与 4 月 24 日发布的 V4-Flash-preview 完全一致
- 本次升级仅重新进行后训练(Post-Training)与对齐优化,没有扩大参数规模——"不堆参数、靠训练方法换能力"
- 官方披露的 9 项 Code Agent 基准全面超越 V4-Pro-Preview:Terminal Bench 2.1 82.7、Cybergym 76.7、Toolathlon verified 70.3、DSBench-FullStack 68.7、DSBench-Hard 59.6、DeepSWE 由 7.3 升至 54.4
- 评测采用 DeepSeek Harness 极简模式、max 档位、top_p=0.95、temperature=1.0;整体表现超过 V4-Pro-Preview 与 GLM-5.2,部分指标逼近 Claude Opus 4.8
原生支持 Responses API,针对性适配 Codex
- 正式版原生支持 Responses API 格式,并针对 Codex 生态完成专项适配
- 开发者一次配置,即可在 Codex CLI、ChatGPT 桌面端、VS Code 的 Codex 插件中直接调用 V4-Flash
- 原有 Chat Completions / Anthropic 兼容接口继续可用,Base URL 与模型名(deepseek-v4-flash)不变,现有部署无需改动即可切换
仅限 Flash API,Pro 正式版在路上
- 本次更新仅覆盖 V4-Flash 的 API 接口,V4-Pro API 及 App/Web 端模型未做更改
- 旧模型名 deepseek-chat / deepseek-reasoner 已于 7 月 24 日停用,分别映射至 V4-Flash 的非思考与思考模式
- 官方表示 V4-Pro 正式版将"尽快发布",App 与 Web 端用户仍需等待
本站解读
- 这轮升级的看点是"不堆参数":284B/13B 的规模没变,能力提升全部来自后训练质量,验证了后训练时代"精调能力"的竞争逻辑
- 从"通用对话"转向"Agent 基础设施":Responses API + Codex 适配意味着模型瞄准的是真实开发工作流,而非单轮问答
- 定价不变(缓存命中输入 0.02 元/百万 token、未命中 1 元、输出 2 元),"加量不加价"对开发者是实在的利好;官方已预告未来将引入峰谷定价,高峰期价格翻倍,生效日期待定
想零配置直接体验 V4-Flash-0731?DeepSeek-V4-Flash-0731 已上线 MonkeyCode——发布当天即可使用,无需配 API Key。免费方案对所有人开放:每天 30M 免费 Token,人人可领,无需信用卡;新模型发布当天即可用(同天支持)。立即免费开始:https://ly.cyberserval.tech/iIETXiF