Nvidia 24. srpna 2026 oznámila, že platforma Vera Rubin NVL72 dosahuje až 30× vyšší efektivity na watt oproti předchůdcům při agentic AI workloadech, které spotřebují 15× více tokenů než standardní chat. Souběžně Nvidia rozšiřuje Vera Rubin NVL72 o vlastní akcelerátor Nvidia Groq 3 LPX, který vstoupil do plné produkce. Specifikace XPU přístupu pro AI továrny publikoval blog Nvidie 24. srpna 2026.
Agentic AI je extrémně náročná na výpočet: podle dat OpenRouteru citovaných Nvidií spotřebuje agent prozkoumávající třeba investiční rozhodnutí 15× více tokenů než jednoduchý chat. Vera Rubin NVL72 je Nvidiina odpověď na tuto realitu.
Platforma má podle Nvidie dosahovat až 30× vyšší efektivity na watt oproti starším systémům. K tomu Nvidia rozšiřuje NVL72 o vlastní akcelerátor Nvidia Groq 3 LPX, který vstoupil do plné produkce a je navržen pro nízkou latenci a velké kontextové okno při agentních workloadech.
Ekonomika AI fabrik se dnes měří v tokenech za sekundu, tokenech na watt a nákladech na token. Kdo na těchto metrikách prohraje, prohraje zakázky. Vera Rubin NVL72 míří přímo na tato čísla.
Proč by vás to mělo zajímat
Větší efektivita hardware znamená nižší cenu za token pro firmy nakupující cloud compute. Počítejte s tím, že Nvidia tuto generaci promítne do ceníků cloudových poskytovatelů v příštích kvartálech, a porovnejte aktuální nabídky dříve, než podepíšete dlouhodobé smlouvy.



