Přeskočit na obsah
ejaj.cz
Modely

Google vyvíjí nový AI čip pro efektivnější provoz modelů Gemini

Modely

Alphabet podle TechCrunch pracuje na proprietárním čipu přímo navrženém pro efektivnější inference modelů Gemini — jde o krok nad rámec dosavadních TPU. Cílem je snížit náklady na provoz největších Gemini modelů, které jsou klíčové pro Google AI produkty užívané stovkami milionů uživatelů. Detaily o architektuře ani datum spuštění nebyly zveřejněny.

Google (resp. mateřský Alphabet) pracuje na zcela novém AI čipu, jehož primárním účelem je zefektivnit provoz modelů rodiny Gemini. Podle TechCrunch jde o projekt odlišný od stávajících TPU — cílem je specializovaná inference hardware, která by snížila energetickou i finanční náročnost provozu velkých jazykových modelů.

Google investuje do vlastního křemíku dlouhodobě, TPU čipy používá interně od roku 2016. Nový čip by měl posunout důraz ještě silněji směrem k inferenci — tedy samotnému spouštění modelů pro miliardy dotazů denně — namísto trénování. Právě inference tvoří stále větší část provozních nákladů AI firem.

Google zveřejnil minimální technické detaily, datum spuštění ani specifikace architektury oznámeny nebyly. Vývoj probíhá v době, kdy čipová nezávislost začíná být pro největší AI hráče strategickou prioritou — Meta, Microsoft i Amazon budují vlastní inference hardware souběžně.

Proč vás to zajímá

Efektivnější inference čip od Googlu může v praxi znamenat nižší ceny za API volání Gemini — pokud jste vývojáři nebo firmy integrující Google AI do svých produktů, může to snížit vaše provozní náklady.

🌅 Podobné novinky každé ráno v 7:00 do mailu

Zdarma, odhlášení jedním klikem v každém e-mailu.

Vyzkoušejte k tomu — z katalogu ejaj.cz

Další novinky

Zpět na přehled AI novinek.