Přeskočit na obsah
ejaj.cz
Modely

Google vyvíjí nový AI čip pro efektivnější provoz modelů Gemini

ModelyZatím jediný zdroj v našem monitoringu. Neznamená to, že je zpráva nepravdivá – jen že jsme k ní zatím nenašli další nezávislý zdroj mezi sledovanými médii.

Alphabet podle TechCrunch pracuje na proprietárním čipu přímo navrženém pro efektivnější inference modelů Gemini – jde o krok nad rámec dosavadních TPU. Cílem je snížit náklady na provoz největších Gemini modelů, které jsou klíčové pro Google AI produkty užívané stovkami milionů uživatelů. Detaily o architektuře ani datum spuštění nebyly zveřejněny.

Google (resp. mateřský Alphabet) pracuje na zcela novém AI čipu, jehož primárním účelem je zefektivnit provoz modelů rodiny Gemini. Podle TechCrunch jde o projekt odlišný od stávajících TPU – cílem je specializovaná inference hardware, která by snížila energetickou i finanční náročnost provozu velkých jazykových modelů.

Google investuje do vlastního křemíku dlouhodobě, TPU čipy používá interně od roku 2016. Nový čip by měl posunout důraz ještě silněji směrem k inferenci – tedy samotnému spouštění modelů pro miliardy dotazů denně – namísto trénování. Právě inference tvoří stále větší část provozních nákladů AI firem.

Google zveřejnil minimální technické detaily, datum spuštění ani specifikace architektury oznámeny nebyly. Vývoj probíhá v době, kdy čipová nezávislost začíná být pro největší AI hráče strategickou prioritou – Meta, Microsoft i Amazon budují vlastní inference hardware souběžně.

Proč by vás to mělo zajímat

Efektivnější inference čip od Googlu může v praxi znamenat nižší ceny za API volání Gemini – pokud jste vývojáři nebo firmy integrující Google AI do svých produktů, může to snížit vaše provozní náklady.

🌅 Podobné novinky každé ráno v 7:00 do mailu

Zdarma, odhlášení jedním klikem v každém e-mailu.

Vyzkoušejte k tomu – z katalogu ejaj.cz

Další novinky

Zpět na přehled AI novinek.