迈向Blackwell原生8/4位RL:Miles端到端MXFP8与NVFP4实践
本文介绍了Miles团队在Blackwell架构上实现的两种原生低精度RL方案:端到端MXFP8与MoE专家per-token NVFP4。通过从checkpoint转换、Megatron训练、SGLang rollout到实时权重更新的全
本文介绍了Miles团队在Blackwell架构上实现的两种原生低精度RL方案:端到端MXFP8与MoE专家per-token NVFP4。通过从checkpoint转换、Megatron训练、SGLang rollout到实时权重更新的全
SGLang Team 披露了 GLM-5.2-NVFP4 在 Blackwell B300 上的两周优化成果:通过 Spec V2、IndexShare MTP、TopK-V2、Indexer Prologue Fusion 与 BF16
NVIDIA首席执行官黄仁勋近日表示,公司Blackwell和Vera Rubin芯片预计将迎来价值1万亿美元的订单。这一惊人预测将NVIDIA的AI硬件销售前景推向新高度。随着AI需求爆炸式增长,Blackwell作为当前旗舰GPU架构已