英伟达财报前夕公布Vera Rubin首测:DeepSeek跑出30倍吞吐、token成本"降35倍",但等AI降价前,先看懂这三层
今天早上,英伟达公布了下一代 Vera Rubin NVL72 整机架的首次真机实测数据。36氪在针对 Agent 工作负载的测试里,按每位用户 160 tokens/s 的交互目标,Vera Rubin 相比上一代 GB300 NVL72,最高实现 30 倍更高的「每兆瓦吞吐量」,token 成本最高降低 35 倍。知乎首测选用的模型是 DeepSeek V4 Pro——8 月 13 日刚发正式
