阿里开源125B千问新旗舰:训练成本降至前代九分之一,定价仅Claude的3%
2026年8月26日,阿里千问团队发布并开源Qwen3.8-Flash-Next,这是一个125B Transformer参数的多模态MoE模型,每token仅激活6B参数,训练成本较上代Qwen3.7-Plus降低90%,API定价每百万
2026年8月26日,阿里千问团队发布并开源Qwen3.8-Flash-Next,这是一个125B Transformer参数的多模态MoE模型,每token仅激活6B参数,训练成本较上代Qwen3.7-Plus降低90%,API定价每百万
加州大学伯克利分校与得克萨斯大学奥斯汀分校团队于2026年8月17日发布FreeToken,这套边缘原生MoE推理引擎通过带宽自适应调度,将本地可运行的参数上限从数十亿推至7530亿:8GB笔记本GPU运行35B模型、游戏台式机运行284B