AMD宣布其首款机架级AI系统Helios将供应微软Azure,用于驱动前沿模型AI推理工作负载,同时支持Azure AI服务和客户应用。Helios预计成本500-550万美元,AMD股价当日上涨8%。Meta和OpenAI已确认客户支持,全球前十大AI公司中有八家在其Instinct GPU上运行工作负载。
事实还原
2026年7月20日,AMD与微软扩大长期合作,微软成为首个公开承诺大规模部署Helios的超大规模云服务商。Helios整合AMD Instinct MI455X GPU、第六代EPYC Venice CPU、Pensando网络技术及ROCm软件栈,每个计算托盘配备四块Instinct GPU,由单颗EPYC CPU驱动,并搭载多达12块基于Pensando技术的网络芯片。AMD计划2026年下半年开始向包括微软在内的客户发货。微软Azure将新增两个基于Venice CPU的虚拟机系列,Azure HDv2面向代理式AI和数据管道工作负载,Azure HXv2面向半导体设计用例。
机制拆解
Helios作为AMD首个机架级系统,采用全栈自研硬件架构,目标是提供最佳总拥有成本和最低每令牌成本。AMD负责硅基础,微软则在Azure云运营、开发者服务、安全和AI平台服务中封装这些组件。合作延续了双方在Surface PC、Xbox及2023年MI300X GPU上的伙伴关系,此次扩展到GPU、CPU、网络和软件全领域。微软CEO纳德拉表示,此举为客户提供构建和运行下一代AI应用所需的性能、规模与选择。AMD数据中心业务负责人Forrest Norrod强调系统级玩法而非单一组件销售,覆盖训练、推理、微调和代理式工作负载。
产业影响
对竞争格局而言,Helios直接对标NVIDIA Grace Blackwell和Vera Rubin系统,NVIDIA当前数据中心GPU市占率超过95%,AMD约占4.5%。若AMD份额升至20%至25%,将对应数千亿美元营收规模。上下游方面,AMD 2026年第一季度数据中心业务营收同比增长57%,并计划从2027年起实现数百亿美元数据中心AI营收,其中大部分来自Helios。开发者可通过Azure Foundry Managed Compute托管生产AI工作负载,企业用户则获得除NVIDIA之外的另一基础设施选项。Meta已承诺随时间推移使用高达6吉瓦AMD GPU,并率先在Helios机架上部署1吉瓦;OpenAI、甲骨文和塔塔咨询服务也作出重大部署承诺。
对照与先例
与NVIDIA第二代机架级系统Vera Rubin相比,Futurum Group估算Helios售价500-550万美元,高于Vera Rubin的350-400万美元。AMD CEO Lisa Su此前表示,Helios在推理性能、内存带宽和内存容量方面相比英伟达机架系统具有显著优势。Counterpoint Research分析师Neil Shah指出,AMD Helios芯片性能与英伟达GPU和CPU相当,但关键在于软件和优化,CUDA生态仍是成熟差距。
战略判断
Helios早期部署表现将决定其能否从产能短缺下的替代选择转变为技术主导者。观察信号包括2026年下半年发货后的实际推理每令牌成本数据,以及Azure HDv2和HXv2实例的使用率。AMD有望在2027年实现数据中心AI营收目标,但软件生态鸿沟仍是最大变量。
开发者选型时,可优先在Azure上测试Helios支持的ROCm优化工作负载,重点验证与现有CUDA代码的兼容性及总拥有成本。企业用户应结合自身推理规模,比较Helios与NVIDIA系统的每令牌成本,同时关注微软新增Venice CPU实例在代理式AI场景下的实际性能。Meta和OpenAI的部署反馈将成为重要参考指标。
© 2026 Winzheng.com 赢政天下 | 转载请注明来源并附原文链接