DeepSeek V4.1 Flash限时内测启动 新架构原生多模态能力上线

2026年9月9日,DeepSeek通过API ID deepseek-v4.1-flash-expires-on-0910上线V4.1 Flash限时内测,单账号并发上限20请求,定价与V4 Flash系列对齐,模型将于9月10日下线。

事实还原

根据Technode报道,DeepSeek已开始V4.1 Flash的多模态模型限时测试。该模型使用全新架构,原生支持多模态能力。官方表示模型在性能、生成速度和成本方面有所提升,但并未将其定位为正式发布版本。开发者可通过DeepSeek现有API选择该ID进行访问,测试期间定价保持与V4 Flash系列一致,每账号支持最多20个并发请求,测试期结束后模型将于9月10日下线。

机制拆解

此次内测的核心在于“全新架构”与“原生多模态”的结合。报道显示,模型通过现有API端点提供访问,开发者无需额外注册即可在限时窗口内调用。并发上限20请求的设计,表明测试阶段对资源使用进行了控制,以匹配Beta阶段的稳定性要求。定价与V4 Flash系列对齐,意味着成本结构未发生变化,开发者可直接对比V4 Flash系列的既有计费模式。

模型计划于9月10日下线,这一设置将测试周期严格限定在一天内。开发者需在短时间内完成初步验证,重点观察多模态输入输出的实际表现,以及与V4 Pro在总耗时和响应速度上的差异。

产业影响

V4.1 Flash的限时内测,为依赖多模态能力的应用开发者提供了短期验证窗口。由于定价与V4 Flash系列一致,成本门槛较低,有助于中小团队快速接入测试。单账号20并发请求的限制,则要求开发者合理规划调用频率,避免在高峰时段受限。

与此同时,模型未被定位为正式发布,意味着其稳定性与长期可用性仍需进一步观察。开发者在集成时需考虑9月10日后的替代方案,避免依赖单一测试版本。

战略判断

【此段为分析而非事实】从现有API访问方式和定价对齐来看,DeepSeek可能希望通过低门槛测试快速收集多模态场景下的反馈数据,为后续正式版本迭代提供依据。短周期下线安排,则可能旨在控制资源投入,同时制造紧迫感以吸引开发者关注。整体策略与行业中常见限时Beta模式一致,但具体效果仍取决于实际调用数据。