Cognition实测NVIDIA Vera Rubin NVL72,推理吞吐最高达GB200 NVL72的4.8倍
Cognition将NVIDIA Vera Rubin NVL72与GB200 NVL72基线对比测试:推理总token吞吐量最高提升至4.8倍,RL输出token吞吐量为3.8倍。消息由CoreWeave发布。
共 1 个事件 · 门户最近更新
Cognition将NVIDIA Vera Rubin NVL72与GB200 NVL72基线对比测试:推理总token吞吐量最高提升至4.8倍,RL输出token吞吐量为3.8倍。消息由CoreWeave发布。