CUDA 15宣称MoE性能提升40%:效率突破还是算力垄断加剧?
据报道,英伟达在SIGGRAPH 2026发布CUDA 15,针对MoE架构进行底层优化,官方宣称训练与推理效率最高提升40%。该信号尚未经独立来源确认,具体测试口径与实际收益待官方文档和第三方基准披露。文章客观分析创新点、潜在不足及开发者
据报道,英伟达在SIGGRAPH 2026发布CUDA 15,针对MoE架构进行底层优化,官方宣称训练与推理效率最高提升40%。该信号尚未经独立来源确认,具体测试口径与实际收益待官方文档和第三方基准披露。文章客观分析创新点、潜在不足及开发者
7月31日,DeepSeek发布V4 Flash模型,采用MoE架构并以MIT许可开放权重,支持100万tokens上下文,定位面向Agent任务的高性价比选择。开发者社区反响积极,但长上下文实际利用率与复杂场景稳定性仍待第三方验证。
Thinking Machines今日发布Inkling-Small,这是一款总参数2760亿、每token激活120亿的MoE模型。其性能与更大规模的Inkling相当,但体积和速度显著优化。全权重已开放于Hugging Face与Tin
Cohere正式开源Command A+,采用218B总参数、25B活跃参数的MoE架构,支持128K上下文与多模态输入。该模型在电信代理任务中得分从37%跃升至85%,终端基准硬难度从3%提升至25%。Apache 2.0许可允许企业自由
中国AI公司DeepSeek推出V2开源大模型,总参数671B却仅激活37B,推理成本降低90%,性能媲美GPT-4o。免费开源后,X中文圈转发超20万,国际开发者下载狂潮涌现,引发全球热议。该模型以MoE架构为核心,打破高性能AI高门槛壁
中国AI公司DeepSeek推出V2开源模型,采用236B参数MoE架构,推理成本仅为GPT-4o的1/30。在Hugging Face平台下载量爆棚,互动超8万。中英文双语能力突出,开发者fork率高涨,助力本土AI生态快速发展。
中国AI公司DeepSeek推出V2模型,在中文数学推理任务中超越GPT-4o,总参数236B却仅激活21B,高效开源架构引爆国内X平台讨论,互动超5万次,彰显中资AI追赶全球势头。
中国AI公司DeepSeek推出V2开源大模型,总参数236B,激活仅21B,推理仅需16GB显存。数学基准超越Llama3,在中文社区转发超15万。性价比突出,助力国产AI崛起,开发者争相测试。