← Zpět na novinky

OpenAI spouští Ultrafast: GPT-5.6 Sol nyní odpovídá 14× rychleji díky čipům Cerebras

2026-08-15 · 4 min čtení

OpenAI přidala do svého modelu GPT-5.6 Sol nový režim Ultrafast, který dosahuje rychlosti až 750 tokenů za sekundu. Za tím stojí partnerství s výrobcem čipů Cerebras v hodnotě 10 miliard dolarů. Výsledkem je tříúrovňový systém rychlostí, kde si uživatelé poprvé mohou vybrat, jak rychle chtějí odpovědi dostávat.

OpenAI spouští Ultrafast: GPT-5.6 Sol nyní odpovídá 14× rychleji díky čipům Cerebras

OpenAI spustila nový režim „Ultrafast" pro model GPT-5.6 Sol, který dosahuje rychlosti až 750 výstupních tokenů za sekundu — to je přibližně 14× více než dřívější standardní provoz. Pohání ho hardware od společnosti Cerebras, s níž OpenAI uzavřela partnerství v hodnotě 10 miliard dolarů.

Co je nového

Model GPT-5.6 Sol nově funguje ve třech rychlostních úrovních: Standard, Fast a Ultrafast. Zatímco Standard odpovídal dosavadnímu tempu, Fast přineslo zrychlení zhruba na dvojnásobek a Ultrafast posouvá laťku na zmíněných 750 tokenů za sekundu.

Pro představu: průměrná věta v češtině má přibližně 15–20 tokenů. Při rychlosti 750 tokenů/s tedy model vygeneruje celou stránku hustého textu dřív, než stihnete mrknout — prakticky bez vnímatelné prodlevy. Tříúrovňový systém přitom mění logiku celého produktu: rychlost inference se stává obchodní proměnnou, za kterou se platí jinak, podobně jako u mobilních dat nebo cloudového úložiště.

Technologicky za tím stojí čipy Wafer Scale Engine od Cerebras, které jsou fyzicky výrazně větší než standardní GPU čipy od Nvidie a díky odlišné architektuře zvládají paralelní zpracování jazykových modelů efektivněji při generování krátkých, rychlých odpovědí.

Jak to vyzkoušet

Režim Ultrafast je dostupný přes API OpenAI. Pokud chcete otestovat rychlostní rozdíl v praxi, použijte například tento prompt pro generování strukturovaného výstupu, kde je rychlost nejlépe měřitelná:

Vygeneruj mi 20 různých nápadů na témata blogových článků o udržitelném cestování. Pro každý nápad uveď: název článku, cílovou skupinu a tři klíčová slova. Formát: číslovaný seznam.

Tento prompt produkuje dostatečně dlouhý výstup (přibližně 400–500 tokenů), aby byl rozdíl mezi režimy subjektivně zřetelný. V API požadavku pak stačí přidat parametr specifikující zvolenou rychlostní úroveň — konkrétní název parametru závisí na aktuální dokumentaci OpenAI.

Kdy se to nehodí

Ultrafast má smysl hlavně tam, kde záleží na nízké latenci a uživatel čeká na odpověď v reálném čase — tedy u chatbotů, hlasových asistentů nebo interaktivních aplikací.

Naopak pro dlouhé analytické úlohy na pozadí (například noční zpracování tisíců dokumentů) je Standard pravděpodobně ekonomičtějším výběrem, protože rychlost zde nehraje klíčovou roli. Ultrafast také zatím nemusí být dostupný pro všechny varianty modelů v portfoliu OpenAI — pokročilejší modely s delším kontextovým oknem nebo rozšířeným uvažováním mohou mít vlastní omezení.

Cerebras hardware je navíc optimalizovaný pro konkrétní typ zátěže: krátké, rychlé generování. U úloh vyžadujících složité víceúrovňové uvažování nemusí být přínos tak výrazný jako u prostého rychlého psaní textu.

Co to znamená pro tebe

Pokud ChatGPT používáte jen příležitostně pro osobní potřebu, tuto změnu pravděpodobně přímo nepocítíte — rychlost standardního rozhraní zůstává funkční. Zásadní posun to ale je pro vývojáře a firmy, kteří nad OpenAI API staví vlastní aplikace.

Představte si zákaznický chatbot, který dnes odpovídá za 3–4 sekundy. S Ultrafast režimem by tentýž výstup dorazil pod půl sekundy, což zásadně mění pocit plynulosti konverzace. Právě tady se otevírá prostor pro novou generaci hlasových a real-time aplikací, které dříve narážely na technické limity.

Pro pokročilé

Konkrétní cenové sazby za tokeny pro jednotlivé režimy (Standard, Fast, Ultrafast) zatím nebyly oficiálně zveřejněny v přehledu cen pro evropský trh. Obecně lze předpokládat, že Ultrafast bude dražší na token než Standard — přesná čísla sledujte na stránce [openai.com/api/pricing](https://openai.com/api/pricing).

Partnerství s Cerebras bylo uzavřeno v objemu 10 miliard dolarů a jde o jeden z největších obchodů s AI infrastrukturou letošního roku. Pro OpenAI znamená diverzifikaci od závislosti na Nvidii, která dominuje trhu s GPU čipy pro trénování i inference velkých jazykových modelů.

Zdroj informací: The Decoder (https://the-decoder.com/gpt-5-6-sol-goes-14x-faster-as-openai-launches-ultrafast-mode-powered-by-cerebras/)

Související nástroje