Alphabet podle TechCrunch pracuje na proprietárním čipu přímo navrženém pro efektivnější inference modelů Gemini – jde o krok nad rámec dosavadních TPU. Cílem je snížit náklady na provoz největších Gemini modelů, které jsou klíčové pro Google AI produkty užívané stovkami milionů uživatelů. Detaily o architektuře ani datum spuštění nebyly zveřejněny.
Google (resp. mateřský Alphabet) pracuje na zcela novém AI čipu, jehož primárním účelem je zefektivnit provoz modelů rodiny Gemini. Podle TechCrunch jde o projekt odlišný od stávajících TPU – cílem je specializovaná inference hardware, která by snížila energetickou i finanční náročnost provozu velkých jazykových modelů.
Google investuje do vlastního křemíku dlouhodobě, TPU čipy používá interně od roku 2016. Nový čip by měl posunout důraz ještě silněji směrem k inferenci – tedy samotnému spouštění modelů pro miliardy dotazů denně – namísto trénování. Právě inference tvoří stále větší část provozních nákladů AI firem.
Google zveřejnil minimální technické detaily, datum spuštění ani specifikace architektury oznámeny nebyly. Vývoj probíhá v době, kdy čipová nezávislost začíná být pro největší AI hráče strategickou prioritou – Meta, Microsoft i Amazon budují vlastní inference hardware souběžně.
Proč by vás to mělo zajímat
Efektivnější inference čip od Googlu může v praxi znamenat nižší ceny za API volání Gemini – pokud jste vývojáři nebo firmy integrující Google AI do svých produktů, může to snížit vaše provozní náklady.



