DeepSeek-V4-Flash正式版API公测上线 支持百万上下文与MoE架构

DeepSeek于2026年7月31日发布V4-Flash正式版API公测,模型名称为deepseek-v4-flash,原生支持Responses API格式并针对性适配Codex。

事实还原

根据官方更新日志,DeepSeek-V4-Flash正式版API已上线公测,DeepSeek-V4-Flash-0731的模型结构、尺寸与DeepSeek-V4-Flash-preview保持一致,仅重新进行了后训练。DeepSeek-V4-Pro正式版将会尽快发布。V4-Flash支持开源权重、MIT许可、百万上下文和MoE架构。

机制拆解

该更新仅针对V4-Flash API,V4-Pro API和APP/WEB模型保持不变。API调用方式未变,仅需将模型名设为deepseek-v4-flash即可使用最新版本。官方博客披露,V4-Flash在Terminal Bench 2.1等基准测试中得分分别为82.7、54.2等。

产业影响

对开发者而言,V4-Flash集成至OpenCode Go等工具后,代码生成与代理任务性能显著提升,支持百万上下文的MoE架构降低了长文本处理成本。对企业用户,MIT许可的开源权重便于私有化部署,Responses API格式适配Codex降低了迁移门槛。

战略判断

基于现有事实,V4-Pro正式版发布后可能进一步提升企业级应用能力,开发者可优先测试V4-Flash在Codex适配场景下的稳定性,以验证其在实际工作流中的表现。