2026-09-10 · 来源:{'name': 'Nvidia Blog', 'url': 'https://blogs.nvidia.com/blog/vera-rubin-nvl72-efficiency-ai-agents/'}

NVIDIA称Vera Rubin NVL72每瓦性能最高提升30倍;OpenRouter数据显示,智能体AI消耗的token量是简单聊天的15倍。
面对智能体AI(Agentic AI)急剧膨胀的算力需求,NVIDIA正将其Vera Rubin NVL72平台作为应对之策。该公司在官方博客中宣称,这套系统每瓦性能最高可提升30倍。NVIDIA将这一数字定位为AI智能体的全新能效标杆,把硬件经济性与本次发布聚焦的工作负载类型直接挂钩。
这一说法的依据来自OpenRouter的使用数据:智能体AI工作负载消耗的token量是简单聊天请求的15倍。差距源于智能体的运行方式:它们不会回答一个问题就收工,而是将多次模型调用串联起来完成一项任务,每一步都在成倍放大token消耗。
NVIDIA用一个投资研究场景来展示这一动态。当智能体受命为投资决策研究一家公司时,它会查询金融数据库、检索新闻和监管文件、调用子智能体进行同业对比与估值建模,最后汇总结果。这个例子说明了智能体的token消耗为何层层叠加:用户的一次请求,会触发数据库查询、文档检索和委派子任务,每一环都在产生额外的推理工作量。
萬安算交所 AIXX · 算力硬件实名会员制交易平台 · 进入货源大厅