腾讯开源Hy4 Preview:770B参数代码基准压制DeepSeek V4 Pro,过度自验拖慢实战交付
2026年8月28日,腾讯混元正式开源Hy4 Preview,总参数770B、激活参数49B、上下文窗口超100万token。在Terminal Bench 2.1代码基准中得分85.4,超越DeepSeek V4 Pro并与Claude
2026年8月28日,腾讯混元正式开源Hy4 Preview,总参数770B、激活参数49B、上下文窗口超100万token。在Terminal Bench 2.1代码基准中得分85.4,超越DeepSeek V4 Pro并与Claude
阿里巴巴Qwen3.8-Max以2.4万亿参数MoE架构开源,同期智谱AI旗下Z.ai将神秘"牛模"Ox Alpha揭晓为GLM-5.3-Flash,320B参数、MIT许可证、API定价仅0.075美元/百万token。两款模型从不同方向
智谱AI于2026年8月26日开源GLM-5.3-Flash(320B-A18B),同日确认其为此前在OpenRouter和OpenCode匿名运行的Ox Alpha。该模型在第三方Artificial Analysis综合智能指数中取得5
Moonshot AI于2026年7月16日发布Kimi K3模型,参数规模2.8万亿,支持百万token上下文和原生视觉处理,计划7月27日开放权重。模型采用896专家MoE架构,每token激活16个专家,宣称较前代提升2.5倍扩展效率
据报道,英伟达在SIGGRAPH 2026发布CUDA 15,针对MoE架构进行底层优化,官方宣称训练与推理效率最高提升40%。该信号尚未经独立来源确认,具体测试口径与实际收益待官方文档和第三方基准披露。文章客观分析创新点、潜在不足及开发者
7月31日,DeepSeek发布V4 Flash模型,采用MoE架构并以MIT许可开放权重,支持100万tokens上下文,定位面向Agent任务的高性价比选择。开发者社区反响积极,但长上下文实际利用率与复杂场景稳定性仍待第三方验证。
Thinking Machines今日发布Inkling-Small,这是一款总参数2760亿、每token激活120亿的MoE模型。其性能与更大规模的Inkling相当,但体积和速度显著优化。全权重已开放于Hugging Face与Tin
Cohere正式开源Command A+,采用218B总参数、25B活跃参数的MoE架构,支持128K上下文与多模态输入。该模型在电信代理任务中得分从37%跃升至85%,终端基准硬难度从3%提升至25%。Apache 2.0许可允许企业自由
中国AI公司DeepSeek推出V2开源大模型,总参数671B却仅激活37B,推理成本降低90%,性能媲美GPT-4o。免费开源后,X中文圈转发超20万,国际开发者下载狂潮涌现,引发全球热议。该模型以MoE架构为核心,打破高性能AI高门槛壁
中国AI公司DeepSeek推出V2开源模型,采用236B参数MoE架构,推理成本仅为GPT-4o的1/30。在Hugging Face平台下载量爆棚,互动超8万。中英文双语能力突出,开发者fork率高涨,助力本土AI生态快速发展。
中国AI公司DeepSeek推出V2模型,在中文数学推理任务中超越GPT-4o,总参数236B却仅激活21B,高效开源架构引爆国内X平台讨论,互动超5万次,彰显中资AI追赶全球势头。
中国AI公司DeepSeek推出V2开源大模型,总参数236B,激活仅21B,推理仅需16GB显存。数学基准超越Llama3,在中文社区转发超15万。性价比突出,助力国产AI崛起,开发者争相测试。