阿里Qwen3.8-Omni-Flash三天反制谷歌Gemini 3.8 Live 音频定价降逾98%

2026年9月18日,阿里巴巴发布Qwen3.8-Omni-Flash,原生全模态模型支持文本、图像、音频、视频输入,API音频输入定价较谷歌Gemini 3.8 Live下降逾98%,视频任务token消耗减少45.7%,29项基准测试平均提升25%。

事实还原

谷歌于2026年9月15日发布Gemini 3.8 Live,并在语音对语音榜单取得领先。阿里巴巴在三天后推出Qwen3.8-Omni-Flash,直接针对音频定价展开竞争。模型支持100万token上下文,视频任务token消耗较此前减少45.7%。

机制拆解

价格战成为本次竞争的核心手段。阿里通过大幅降低音频输入定价,试图在成本层面形成优势。谷歌此前凭借Gemini 3.8 Live占据语音交互领先位置,阿里选择在短时间内以价格反制,体现出对多模态语音AI市场的快速响应。

视频任务token消耗减少45.7%这一事实,显示模型在效率优化上有所进展。29项基准测试平均提升25%,为性能提升提供了量化依据。

产业影响

此次发布可能加剧中美多模态AI领域的价格竞争。音频定价的显著下降,有助于降低开发者接入门槛,但也对其他厂商的盈利模式形成压力。支持100万token上下文的特性,可能推动长上下文应用场景的发展。

战略判断

【分析】价格战可能短期内改变市场份额分布,但长期可持续性取决于模型实际性能与生态建设。Qwen3.8-Omni-Flash的推出,反映出中国企业在多模态领域正通过成本策略加速追赶。未来评测需关注其在真实场景中的表现,以判断是否能持续保持竞争力。