2026-07-09 · 4 min čtení
OpenAI vydalo aktualizované hlasové modely, které zvládají simultánní mluvení i poslouchání. Díky tomu se konverzace s AI přibližuje přirozenému lidskému dialogu a otevírají se dveře pro živý překlad v reálném čase.
Představte si, že mluvíte s člověkem, který vás pozorně poslouchá — a přitom je schopen kdykoli plynule reagovat, aniž by čekal, než domluvíte větu do konce. Přesně takový zážitek se OpenAI snaží přinést do světa umělé inteligence. Společnost právě vydala nové hlasové modely, jejichž klíčová vlastnost je na první pohled jednoduchá, ale technicky velmi náročná: umí mluvit a poslouchat současně.
Dosavadní hlasové systémy — ať už v ChatGPT nebo u jiných asistentů — fungovaly podobně jako starší vysílačky. Buď mluvil uživatel, nebo odpovídala AI. Obě strany se musely střídat. Pokud jste chtěli něco doplnit nebo AI přerušit, museli jste počkat, až domluví.
Nové modely tento princip opouštějí. AI nyní dokáže průběžně vnímat váš hlas i ve chvíli, kdy sama mluví. To jí umožňuje reagovat na vaše přerušení, zaznamenat, že jste začali hovořit, nebo přizpůsobit odpověď na základě toho, co říkáte v reálném čase. Výsledek je rozhovor, který se daleko víc podobá běžné lidské komunikaci.
Největší praktický přínos vidí OpenAI právě v oblasti simultánního tlumočení. Živý překlad — tedy takový, kde jedna osoba mluví a překlad zaznívá prakticky okamžitě — byl dosud výsadou profesionálních tlumočníků nebo velmi specializovaného softwaru.
Nové hlasové modely otevírají cestu k tomu, aby tuto funkci zvládla běžná AI aplikace. Pokud AI dokáže naslouchat a zároveň produkovat přeložený výstup, může překlad probíhat s minimálním zpožděním. To je zásadní rozdíl oproti systémům, které nejprve celou promluvu zaznamenají, pak ji zpracují a teprve potom přeloží — takový přístup totiž vytváří nepříjemné prodlevy, které přirozený rozhovor přes jazykovou bariéru prakticky znemožňují.
Pokud používáte hlasový režim ChatGPT, brzy byste měli pocítit, že konverzace s asistentkou plyne přirozeněji. Nebudete muset čekat na tikající kurzor a AI vás nebude „přehlušovat" tím, že ignoruje váš vstup uprostřed své odpovědi.
Pro cestování nebo pracovní schůzky s cizojazyčnými partnery se rýsuje zajímavá možnost: telefon nebo tablet jako kapesní tlumočník, který přeloží konverzaci takřka v reálném čase, aniž by přirozenost dialogu trpěla nepřirozenými pauzami.
Samozřejmě je třeba počítat s tím, že technologie není dokonalá. Živý překlad v plné kvalitě je extrémně náročný úkol — nejen jazykově, ale i kontextově. AI musí rozumět přerušením, opravám, nedokončeným větám i přízvukům. Nové modely jsou krokem správným směrem, nikoli hotovým řešením pro všechny situace.
OpenAI není v tomto prostoru sama. Společnosti jako Google, Apple nebo Meta rovněž intenzivně pracují na hlasových asistentských systémech, které by zvládaly přirozený dialog bez otravných prodlev a přerušení. Trh s hlasovými AI rozhraními rychle roste — a přirozenost konverzace se stává jedním z hlavních konkurenčních bojišť.
Pro česky mluvící uživatele to přináší zajímavou perspektivu: čeština patří mezi jazyky, kde kvalita hlasových modelů historicky zaostávala za angličtinou. Pokud OpenAI s novými modely zlepší i vícejazyčnou podporu, může to znamenat výrazný posun i pro nás.
Nové hlasové modely OpenAI jsou zatím dostupné vývojářům přes API. Kdy a v jaké podobě se promítnou do uživatelských aplikací jako ChatGPT, zatím není přesně upřesněno.
Zdroj informací: TechCrunch AI (https://techcrunch.com/2026/07/08/openai-releases-new-voice-models-for-more-natural-live-conversations/)