Nejrozšířenější AI ekosystém — Custom GPTs, Assistants, Realtime API
Univerzální nasazení — od běžné práce přes obsah a kódování po produkční AI aplikace a hlasové agenty.
Modely
GPT-5.6 Sol — Nová vlajková loď (GA 9. 7. 2026) — dle OpenAI dosud nejlepší coding model, o 54 % vyšší tokenová efektivita při kódování, komplexní reasoning a agentické workflow
GPT-5.6 Terra — Střední varianta rodiny 5.6 — kompromis výkonu a ceny pro každodenní práci
GPT-5.6 Luna — Nejlehčí a nejrychlejší z rodiny 5.6 — objemové a rychlé úlohy
GPT-5.5 / 5.5 Pro — Předchozí generace — postupně nahrazována rodinou GPT-5.6; Pro dál v ChatGPT Pro ($200/měs)
GPT-5.4 mini — Levný a rychlý model pro objemové úlohy ($0.15/1M tokenů)
GPT-5.4 nano — Nejlevnější model pro jednoduché klasifikace a extrakce
GPT Image — Generování a editace obrázků integrované v ChatGPT a API (nástupce DALL-E)
Whisper — Speech-to-text model pro přepis audio/video
TTS — Text-to-speech s 6 hlasy, přirozená intonace
Embeddings — text-embedding-3-small/large pro RAG a sémantické vyhledávání
Silné stránky
Nejrozšířenější ekosystém s největší komunitou
Špičkový výkon napříč textem, obrazem i hlasem
Custom GPTs a bohaté API pro vývojáře
Multimodální — text, obrázky, hlas i video v jednom
Anthropic
Claude Fable 5 — nejschopnější veřejně dostupný model, MCP, Claude Code, Cowork
Kódování, agentické workflow, právní a analytické dokumenty, bezpečné nasazení v firmách.
Modely
Claude Fable 5 — Nejschopnější veřejně dostupný model (třída Mythos) — 1M token kontext, špička v kódování i znalostní práci. Od 19. 7. 2026 v placených plánech přes usage kredity; API $10/$50 za 1M tokenů (nejdražší GA model na trhu)
Claude Mythos 5 — Stejný model bez dodatečných bezpečnostních klasifikátorů — dostupný pouze prověřeným organizacím (Project Glasswing)
Claude Opus 4.8 — Dosavadní vlajkový model — složité agentické workflow, code review, strategické dokumenty, adaptivní reasoning
Claude Sonnet 4.6 — Nejlepší poměr cena/výkon — doporučený pro většinu API úloh
Claude Haiku 4.5 — Rychlý a levný model pro jednoduché úkoly a real-time aplikace
Claude Opus 4.8 + Extended Thinking — Adaptivní reasoning pro matematiku, logiku a komplexní úlohy
Claude Code — Specializovaný agent pro kódování přes CLI, desktop i mobil
Silné stránky
Claude Fable 5 — aktuálně nejschopnější veřejně dostupný model (7/2026)
Špička v kódování a dlouhých dokumentech
Nejvyšší odolnost vůči prompt-injection (bezpečnost)
MCP protokol pro propojení s nástroji a daty
Claude Code a Cowork pro agentickou práci
Google / DeepMind
Gemini 3.5, Gemini Omni, NotebookLM, AI Studio — 1M token kontext
Práce s velkými dokumenty, multimédii a uživatelé žijící v Google ekosystému (Gmail, Docs, Android).
Modely
Gemini 3.5 Pro (očekávaný) — Nová vlajková loď — Google ji po kompletní přestavbě architektury cílil na 17. 7. 2026; neoficiálně 2M token kontext a Deep Think vrstva. Specifikace zatím nepotvrzeny
Gemini 3.5 Flash — Výchozí model Gemini aplikace — rychlý, multimodální, skvělý poměr cena/výkon
Gemini 3.1 Pro — Aktuálně nejsilnější všeobecně dostupný Gemini v API (2/2026) — kód, dlouhý kontext, multimodalita
Gemini 3 Deep Think — Režim hlubokého uvažování pro matematiku, vědu a složité problémy
Gemini Omni — Nová generace generování videa se zvukem (nástupce Veo)
Nano Banana 2 — Aktuální model pro generování a editaci obrázků (nástupce Imagen)
Lyria 3 Pro — Generování hudby z textového zadání
NotebookLM — Specializovaný produkt pro analýzu dokumentů a zdrojů
Gemini Embeddings — Embeddings pro RAG aplikace
Silné stránky
Obří kontextové okno pro rozsáhlé dokumenty
Hluboká integrace s Google Workspace a Androidem
Silné multimodální schopnosti (Veo na video, Imagen na obraz)
Velkorysý free tier
Mistral AI
Evropský open-weight LLM — GDPR, Devstral, self-hosting, Agents API
Evropské firmy s důrazem na GDPR, self-hosting a datovou suverenitu; nákladově efektivní nasazení.
Modely
Mistral Large 3 — Flagship open-weight multimodální model s velkým kontextem — konkuruje GPT-5.5
Mistral Medium 3.5 — Vyvážený model pro firemní nasazení — výkon za nízkou cenu
Devstral 2 — Specializovaný model pro software development — coding + code review
Codestral — Rychlý coding model pro autocomplete — integrace ve VS Code a JetBrains
Mistral Small — Levný a rychlý model pro jednoduché úkoly
Mistral Embed — Embedding model pro RAG aplikace — jeden z nejlepších na trhu
Mistral Nemo — Multilingual model — výborný pro jazyky mimo angličtinu
Silné stránky
Evropský provider — GDPR a data v EU
Open-weight modely k self-hostingu
Dobrá cena a rychlost
Vhodné pro firmy řešící suverenitu dat
Meta AI / Llama
Llama 4 Scout/Maverick/Behemoth — open-source, zdarma, vlastní hosting
Vývojáři a firmy chtějící self-hosting, fine-tuning na vlastní data a nezávislost na cloudových providerech.
Modely
Llama 4 Scout — Efektivní model pro zpracování textu a reasoning — 17B aktivních parametrů (MoE)
Llama 4 Maverick — Silnější model pro komplexní úkoly — multimodální
Llama 4 Behemoth — Největší Llama model (preview) — konkurent GPT-5.5
Llama 3.3 70B — Stabilní a dobře testovaný model pro produkci
CodeLlama — Specializovaný model pro generování kódu
Silné stránky
Nejpopulárnější open-weight rodina (Llama)
Zdarma k použití i komerčně (dle licence)
Obří komunita, nástroje a fine-tuny
Plná kontrola při self-hostingu
xAI (Grok)
Grok 4.5 — real-time data z X, agresivní ceny API ($2/$6 za 1M tokenů)
Aktuální dění a research nad živými daty z X, levné agentické API úlohy, kódování s dobrým poměrem cena/výkon.
Modely
Grok 4.5 — Vlajkový model (8. 7. 2026) — kódování, agentické úlohy, znalostní práce; $2/$6 za 1M tokenů, dostupný i v Cursoru
Grok 4.3 — Předchozí vlajková loď (4/2026) — nativní video vstup, generování PDF/tabulek/prezentací, znalosti do 12/2025
Grok 4 mini — Levná a rychlá varianta pro objemové úlohy
Grok Imagine — Generování obrázků a krátkých videí v aplikaci Grok
Silné stránky
Real-time přístup k datům z X/Twitteru — aktuální dění bez zpoždění
Výrazně levné API — Grok 4.5 za $2/$6 na 1M tokenů (zlomek ceny špičky)
Nativní video vstup a generování dokumentů (PDF, tabulky, prezentace)
Konfigurovatelný reasoning effort — platíš jen za přemýšlení, které potřebuješ
DeepSeek
V4 — špičkový reasoning za zlomek ceny, open-weight, thinking mode
Nákladově efektivní reasoning a bulk zpracování přes API; self-hosting pro firmy, které chtějí špičkový open-weight model.
Modely
DeepSeek V4-Pro — Vlajkový model — 1M kontext, thinking mode, reasoning na úrovni špičky; stable verze ohlášena na 24. 7. 2026
DeepSeek V4-Flash — Levný a rychlý — $0.14/$0.28 za 1M tokenů, nejlevnější silný model na trhu
DeepSeek R2 — Reasoning řada — krokové uvažování pro matematiku a logiku
DeepSeek Coder — Specializace na kód — oblíbený v open-source komunitě
Silné stránky
Řádově nejlevnější silné modely — V4-Flash od $0.14/1M tokenů
Open-weight — možnost self-hostingu a plné kontroly nad daty
Reasoning (thinking mode) srovnatelný se západní špičkou
Aplikace i API zdarma/velmi levně — ideální na experimenty