OpenAI Jalapeño芯片:推理速度与能效双冠
OpenAI的Jalapeño自研推理芯片在SemiAnalysis的InferenceX基准测试中取得优秀成绩,每用户Token生成量与每千瓦吞吐量均超过当前市场上的最先进产品。该芯片针对大规模快速推理场景进行了精心优化,有望大幅降低大模
OpenAI的Jalapeño自研推理芯片在SemiAnalysis的InferenceX基准测试中取得优秀成绩,每用户Token生成量与每千瓦吞吐量均超过当前市场上的最先进产品。该芯片针对大规模快速推理场景进行了精心优化,有望大幅降低大模
MLPerf自2018年推出以来,已成为衡量AI系统性能的行业标准,追踪到大语言模型推理能效提升超100倍、训练速度提升超50倍。随着AI服务广泛应用,企业采购推理算力需求日益复杂,MLCommons正式推出MLPerf Endpoints
MLCommons近日公布了行业标准MLPerf Inference v6.0基准测试套件的最新结果。此次更新包括五个数据中心测试的新增或升级,以及边缘系统的全新物体检测测试。主要亮点有基于GPT-OSS 120B的开源大语言模型基准、扩展
SGLang团队与NVIDIA紧密合作,在多代GPU上为大规模MoE推理模型部署带来阶跃式性能提升。继Blackwell B200对比Hopper H200实现4倍加速后,现扩展至Blackwell Ultra的GB300 NVL72,在I