英伟达首次测评Vera Rubin,DeepSeek表现爆炸性提升!

新闻中心

4217

英伟达近期公布了其全新旗舰级机柜Vera Rubin NVL72的首次测试结果,带来了令人震惊的变化。这次测试选用了DeepSeek-V4-Pro进行的“智能体编码”任务,结果显示,Vera Rubin在每兆瓦的吞吐量上竟然较当前的主力产品GB300 NVL72提高了整整30倍,同时Token的成本也下降了最高35倍。许多人对此感到不可思议,甚至有人直言:“我连给投资人准备的PPT都不敢这么写!”还有网友戏谑道:“过去觉得三万美元的H200太贵,现在回头看看,它竟然连基础版都算不上。”

细致分析,从H200到GB300,真实的Agent工作负载已经实现了最高30倍的吞吐量增长,而成本大约翻了一番。再从GB300到Vera Rubin,吞吐量依然提升最多30倍,整机架的价格也大致翻了一倍。这意味着,过去两年英伟达的重大技术突破不再是GPU本身,而是通过让价格增至四倍,换来了惊人的900倍的速度提升!此次发布也标志着一个时代的转变,英伟达指出LLM时代的结束,Agent时代的来临,旧有的AI性能基准彻底失效。同时,专门为智能体设计的Vera CPU已经被马斯克的SpaceXAI迅速装机,甚至计划直接用于太空任务。

about image

与此同期,英伟达的Groq 3 LPX也开始全面量产,与Gemma 4 31B搭配使用,达到每秒3400个Token的速度,万亿参数模型的吞吐量提升35倍。这些新记录彻底改变了Agent生态的商业格局,表明了为什么英伟达需要推出Vera Rubin的原因。根据OpenRouter的最新数据显示,实际的Agent AI任务消耗的Token数量是普通聊天对话的15倍,这就说明了在智能体和子智能体进行投资决策等复杂任务时,Token的增长对上下文处理构成了巨大的挑战。

about image

智能体交互次数越多,吞吐量也随之增加:智能体数量翻倍,工具调用在增加。因此,传统的AI基准测试(比如固定长度的8K/1K序列测试)将显得毫无价值。英伟达明确表示,必须对性能测试进行进化,不能再用单一推理请求作为衡量标准,而是要全方位捕捉Agent的工作流程。这就解释了为什么H200在新的Agent战场上力不从心,而Vera Rubin则注定要脱颖而出。

about image

为验证Vera Rubin NVL72的实力,英伟达采用了开源的DeepSeek-V4-Pro (1.6T)进行测试,结果令人震惊——在AgentX工作负载下,Vera Rubin NVL72的每兆瓦吞吐量相比GB300 NVL72提升了30倍!这说明,与同样优秀的GB300相比,Vera Rubin可在相同电力预算下实现30倍的智能体运算能力,相当于为兆瓦甚至吉瓦级别的数据中心增添了30倍的算力资产。同时,NVIDIA DSX MaxLPS技术也为电力管理提供了支持,使得在相同的电力预算下,所配置的GPU数量能够提高40%,进一步提升了每兆瓦的吞吐量。

此外,Vera Rubin NVL72在每百万Token的生产成本上较GB300 NVL72最高降低了35倍,推理成本的大幅度下降将使得24小时无休的数字员工成为可能,并为ToC端超级应用的爆发创造条件。英伟达将这一切归功于“极致协同设计”,通过分离式服务、分布式KV缓存和KV感知路由等技术,Vera Rubin NVL72实现了性能的飞跃。

我参加了这家篮球俱乐部的进阶班,教练帮助我分析了很多比赛中的问题,我的进攻和防守都有了很大提高!...

我参加了这家篮球俱乐部的进阶班,教练帮助我分析了很多比赛中的问题,我的进攻和防守都有了很大提高!...