Alphabet podle TechCrunch pracuje na proprietárním čipu přímo navrženém pro efektivnější inference modelů Gemini — jde o krok nad rámec dosavadních TPU. Cílem je snížit náklady na provoz největších Gemini modelů, které jsou klíčové pro Google AI produkty užívané stovkami milionů uživatelů. Detaily o architektuře ani datum spuštění nebyly zveřejněny.
Google (resp. mateřský Alphabet) pracuje na zcela novém AI čipu, jehož primárním účelem je zefektivnit provoz modelů rodiny Gemini. Podle TechCrunch jde o projekt odlišný od stávajících TPU — cílem je specializovaná inference hardware, která by snížila energetickou i finanční náročnost provozu velkých jazykových modelů.
Google investuje do vlastního křemíku dlouhodobě, TPU čipy používá interně od roku 2016. Nový čip by měl posunout důraz ještě silněji směrem k inferenci — tedy samotnému spouštění modelů pro miliardy dotazů denně — namísto trénování. Právě inference tvoří stále větší část provozních nákladů AI firem.
Google zveřejnil minimální technické detaily, datum spuštění ani specifikace architektury oznámeny nebyly. Vývoj probíhá v době, kdy čipová nezávislost začíná být pro největší AI hráče strategickou prioritou — Meta, Microsoft i Amazon budují vlastní inference hardware souběžně.
Proč vás to zajímá
Efektivnější inference čip od Googlu může v praxi znamenat nižší ceny za API volání Gemini — pokud jste vývojáři nebo firmy integrující Google AI do svých produktů, může to snížit vaše provozní náklady.



