阿里巴巴发布2.4万亿参数Qwen3.8-Max 开放权重或加速行业竞争

阿里巴巴于2026年8月推出Qwen3.8-Max模型,总参数达到2.4万亿,激活参数约950亿。该模型支持最高100万token上下文窗口,已通过QwenCloud API开放调用,开放权重计划在8月10日所在周通过Hugging Face和ModelScope发布。

模型核心规格与可用性

Qwen3.8-Max基于Qwen3.5架构构建,支持文本、图像和视频输入,输出为文本。最大输入长度为99.1万token,思考模式下略有降低;最大输出13.1万token,推理预算上限26.2万token。API定价为每百万输入token 2美元,每百万输出token 6美元,缓存读取成本更低。该模型兼容OpenAI和DashScope接口,集成仅需修改基础URL和模型ID。

基准表现与实际执行

在Terminal-Bench 2.1测试中,Qwen3.8-Max得分为86.6,高于Claude Opus 4.8和Fable 5的84.6,仅次于GPT-5.6 Sol的88.8。SWE-bench Pro得67.7,FrontierSWE得73.5,均低于Fable 5对应分数。但在PaperBench达到93.0,IFBench 82.8,GPQA Diamond 92.6。视觉相关基准如OSWorld-Verified 86.1、Parametric CAD Bench 91.5、OmniDocBench 1.5均居前列。

内部测试显示,该模型能独立完成长周期任务。一项自主编码演示中,模型从空仓库开始,连续运行超过16天,生成265次提交、127个拉取请求和151个问题,包含自动化构建、单元测试和恢复机制。另一项复现研究论文实验的任务中,模型连续工作125小时,编写7600行代码,完成1100余次操作和33轮GPU训练,最终方法使AIME24基准提升2.7个百分点。

开放权重带来的产业变化

此前Qwen系列Max级别模型未开放权重,此次计划公开2.4万亿参数版本及27B小模型,允许用户在本地部署和微调。27B版本适合普通GPU硬件,而2.4万亿版本仍需多节点数据中心环境。开放后,软件工程、法律文档审查、媒体运营和设计等领域可直接使用仓库级编码代理和长视频索引工具。

市场即时反应为阿里股价在香港市场单日上涨7.3%。分析人士指出,中国开发者在芯片限制下仍能快速缩小与Anthropic、OpenAI的差距,此次发布是又一例证。

深层驱动因素

模型激活参数仅950亿,推理时仅部分参数参与,降低了计算成本和延迟。这反映出混合专家架构在效率上的实际优化,而非单纯追求总参数规模。长时程自主执行能力来自对反馈循环、任务分配和异常恢复的内置支持,使模型能将用户输入转化为可执行项目而非单次回答。

与Fable 5在部分基准接近或超越,表明中国团队在多模态代理和长文档处理上的针对性投入已产生可量化结果。开放权重决定则可能源于对生态构建的考量,通过允许第三方定制加速应用落地,同时在出口管制环境下扩大影响力。

独立判断

Qwen3.8-Max的发布显示,参数规模与实际部署效率可以并存,开放权重将加速中国AI应用的落地速度,但2.4万亿模型的本地运行门槛仍高,短期内API仍是主要使用方式。其在自主编码和研究复现上的表现已超出单一问答范畴,未来价值取决于开发者能否在真实项目中稳定复现内部测试结果。