OpenAI spustilo preview režimu Ultrafast pro model GPT-5.6 Sol, který dosahuje až 750 výstupních tokenů za sekundu – 14× více než standardní provoz. Nový tier pohání hardware od Cerebras a míří na firemní zákazníky vyžadující okamžité odpovědi v produkčních systémech. TechCrunch potvrzuje, že šlo o cílený tah k získání podnikového segmentu trhu.
Ultrafast není nový model, ale nová vrstva služby nad stávajícím GPT-5.6 Sol. OpenAI ho pohání přes Cerebras a v preview nabízí vývojářům přes API až 750 výstupních tokenů za sekundu. Pro srovnání: standardní provoz modelu se pohybuje přibližně 50–55 tokeny za sekundu, takže zrychlení je velmi výrazné a otevírá typy aplikací, kde latence dosud bránila nasazení.
Zveřejněná příručka pro vývojáře zároveň popisuje, jak kombinovat Ultrafast s Responses API a chytřejším výběrem modelů tak, aby agentní workflow vycházelo levněji. OpenAI tedy útočí na enterprise zákazníky dvojím způsobem: rychlostí i racionalizací nákladů.
Paralelně s tím proběhla výměna na postu Chief Revenue Officer. Denise Dresserová odchází po necelých devíti měsících ve funkci; nahradí ji Dali Rajič, dosavadní prezident a provozní ředitel bezpečnostní firmy Wiz. Nástup se očekává v řádu týdnů.
Proč by vás to mělo zajímat
Rychlost 750 tokenů za sekundu mění kalkulaci pro hlasové asistenty a real-time zákaznické chatboty – latence, která je dosud blokovala, teď mizí.




