OpenAI 8. července 2026 zveřejnila technický přehled systému GPT-Live, který umožňuje nepřerušovanou hlasovou interakci bez přechodů na text. Architektura staví na full-duplex modelu řeči s nízkou latencí; celý systém tým postavil a nasadil za šest měsíců. Cílem je přirozená konverzace bez pauzy čekající na přepnutí řady.
Klasické hlasové asistenty trpí tzv. turn-taking problémem: systém čeká, až uživatel domluví, zpracuje vstup a teprve pak odpoví. GPT-Live tento model opouští ve prospěch kontinuálního proudu: model naslouchá a reaguje průběžně, podobně jako člověk v reálné konverzaci.
OpenAI popisuje dvě klíčové technické volby: tzv. full-duplex architekturu, která nevyžaduje explicitní signál konce promluvy, a architekturu s nízkou latencí, jež zkracuje dobu odezvy pod vnímatelnou hranici.
Projekt trval šest měsíců od nápadu k produkčnímu nasazení. Pro OpenAI je to ukázka rychlosti, s jakou dnes dokáže prototyp převést do reálného produktu.
Proč by vás to mělo zajímat
Vývojáři budující hlasové aplikace na OpenAI API získávají přístup ke komponentám, které řeší jeden z největších UX problémů hlasových botů – nepřirozenou pauzu před odpovědí.



