NVIDIA Nemotron-TwoTower提出扩散语言模型双塔架构
NVIDIA 研究团队发布 Nemotron-TwoTower 论文,提出将上下文塔和扩散去噪塔解耦,在 30B 混合模型上保留 98.7% 基线质量,同时实现 2.42 倍生成吞吐提升。
NVIDIA 研究团队发布 Nemotron-TwoTower 论文,提出将上下文塔和扩散去噪塔解耦,在 30B 混合模型上保留 98.7% 基线质量,同时实现 2.42 倍生成吞吐提升。
NVIDIA于5月19日正式推出Nemotron-Labs-Diffusion系列模型,支持多token并行生成与动态修订,模型规模覆盖3B至14B,并包含视觉语言变体。该模型旨在更好利用现代GPU资源提升推理速度。本文从创新点、不足、同类