Nvidia 16. září 2026 zveřejnila výsledky MLPerf Inference v6.1, kde systém Vera Rubin NVL72 debutoval s vedoucím výkonem. Nvidia zároveň s Emerald AI a Google oznámila alianci pro flexibilní energetické řízení AI datových center. Celá AI Infra Summit agenda se soustředila na efektivitu tokenů na watt jako klíčový ekonomický ukazatel.
MLPerf Inference v6.1 přineslo první veřejné srovnání nové generace hardwaru Nvidia. Systém Vera Rubin NVL72 debutoval s nejlepším výsledkem v kategorii inference výkonu. Nvidia zdůrazňuje, že vyšší výkon přepočtený na infrastrukturu přímo snižuje cenu za generovaný token – klíčový ekonomický ukazatel provozu AI factory.
Souběžně Nvidia, Google a startup Emerald AI vyhlásily novou alianci zaměřenou na flexibilní energetické řízení AI datových center. Silicon Valley Power již testovala schopnost AI factory reagovat na výkyvy energetické sítě v reálném čase – systém dokázal upravit spotřebu na signál distributora.
Na AI Infra Summitu Ian Buck z Nvidie prezentoval platformu DSX a zdůraznil, že klíčovým měřítkem nové éry není surový výkon, ale tokeny na watt. Energetická efektivita se stává konkurenční výhodou stejně důležitou jako rychlost čipů.
Proč by vás to mělo zajímat
Firmy plánující nákup nebo pronájem AI compute kapacity by měly benchmarky MLPerf Inference v6.1 zařadit do svého hodnocení dodavatelů – tokeny na watt a celková efektivita systému stále více rozhodují o skutečných nákladech na provoz.


