
Nejlevnější LLM API v roce 2026: kompletní srovnání cen, 19 modelů
Publikováno 25. 7. 2026
Pokud vybíráte LLM API čistě podle ceny, rozptyl je větší, než většina lidí čeká. Při srovnání všech 19 modelů, které sleduje zdejší LLM API Pricing Calculator — OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot/Kimi, Zhipu/GLM a xAI — se nejlevnější a nejdražší model při srovnatelném zatížení liší více než 60násobně. Tenhle rozdíl je mnohem důležitější než to, na čí logo jste zvyklí.
Žebříček
Aby bylo srovnání férové, každý model níže je hodnocen podle kombinované sazby: 750 000 vstupních tokenů + 250 000 výstupních tokenů na 1M celkových tokenů, což zhruba odpovídá typickému chatovému požadavku, kde je odpověď kratší než prompt. Ceny jsou za 1M tokenů a jsou ověřené proti oficiálním ceníkům jednotlivých poskytovatelů.
| Pořadí | Model | Poskytovatel | Vstup | Výstup | Kombinovaná (3:1) |
|---|---|---|---|---|---|
| 1 | Gemini 2.5 Flash-Lite | $0.10 | $0.40 | $0.175 | |
| 1 | DeepSeek V4 Flash | DeepSeek | $0.14 | $0.28 | $0.175 |
| 3 | Qwen3.6 Flash | Qwen | $0.19 | $1.13 | $0.42 |
| 4 | GPT-5.4 Nano | OpenAI | $0.20 | $1.25 | $0.46 |
| 5 | DeepSeek V4 Pro | DeepSeek | $0.44 | $0.87 | $0.54 |
| 6 | Grok Code Fast 1 | xAI | $1.00 | $2.00 | $1.25 |
| 7 | GPT-5.4 Mini | OpenAI | $0.75 | $4.50 | $1.69 |
| 8 | Claude Haiku 4.5 | Anthropic | $1.00 | $5.00 | $2.00 |
| 9 | GLM-5.2 | Zhipu | $1.40 | $4.40 | $2.15 |
| 10 | GPT-5.6 Luna | OpenAI | $1.00 | $6.00 | $2.25 |
| 11 | Grok 4.5 | xAI | $2.00 | $6.00 | $3.00 |
| 12 | Gemini 3.5 Flash | $1.50 | $9.00 | $3.38 | |
| 13 | Qwen3.7 Max | Qwen | $2.50 | $7.50 | $3.75 |
| 14 | Claude Sonnet 5 | Anthropic | $2.00 | $10.00 | $4.00 |
| 15 | Gemini 3.1 Pro Preview | $2.00 | $12.00 | $4.50 | |
| 16 | GPT-5.6 Terra | OpenAI | $2.50 | $15.00 | $5.63 |
| 17 | Kimi K3 | Moonshot | $3.00 | $15.00 | $6.00 |
| 18 | Claude Opus 5 | Anthropic | $5.00 | $25.00 | $10.00 |
| 19 | GPT-5.6 Sol | OpenAI | $5.00 | $30.00 | $11.25 |
Několik věcí stojí za pozornost. Každý poskytovatel — ne jen jeden — má jak rozpočtovou, tak vlajkovou řadu, které se od sebe liší několikanásobně, takže otázka „který dodavatel je nejlevnější“ je špatně položená; správná otázka zní „který konkrétní model“. Za druhé, dva nejlevnější modely (Gemini 2.5 Flash-Lite a DeepSeek V4 Flash) končí na naprosto stejné kombinované sazbě, přestože pocházejí od nesouvisejících firem — na úplně spodním konci se ceny rozpočtové úrovně sblížily, místo aby jeden dodavatel podrážel ostatní.
Proč nejlevnější model není automaticky ta správná volba
Cena sama o sobě neříká, jestli je model pro vaši úlohu dost dobrý. Rozpočtové modely obvykle stačí na klasifikaci, extrakci, krátké odpovědi a další úzce vymezené úlohy — tedy práci, kde by extra schopnosti vlajkového modelu zůstaly nevyužité. Hůř se hodí na otevřené uvažování, dlouhé vícekrokové agentní workflow nebo úlohy, kde je špatná odpověď drahá na pozdější odhalení; levnější model, který úlohu zkazí a potřebuje opakovaný pokus (nebo lidskou opravu), může nakonec stát víc než dražší model, který ji zvládne napoprvé.
Rozumný výchozí postup: prototypujte s modelem, který znáte nejlépe, a jakmile je úloha dobře definovaná, otestujte, jestli rozpočtový model ze stejné tabulky dává přijatelně podobný výstup — pokud ano, úspory se ve velkém měřítku sčítají; pokud ne, cenový rozdíl stejně nebyl tím skutečným nákladovým faktorem.
Jak zjistit své skutečné číslo
Tabulka používá pevný poměr 3:1, aby šlo modely vůbec seřadit, ale váš reálný poměr vstupních a výstupních tokenů skoro jistě 3:1 není — sumarizace může být 10:1, generování kódu spíš 1:2. Kombinované pořadí výše je rozumný výchozí bod pro výběr kandidátů k otestování, ne náhrada za výpočet vašich konkrétních nákladů.
K tomu použijte přímo LLM API Pricing Calculator: zadejte skutečné počty vstupních a výstupních tokenů a nástroj spočítá přesnou cenu pro kterýkoli z těchto 19 modelů, plus měsíční odhad, pokud zhruba víte, kolik požadavků uděláte. Pokud počty tokenů zatím neznáte, nástroj Token Counter vám dá skutečné číslo z reálného promptu místo hrubého odhadu. Oba běží kompletně ve vašem prohlížeči — žádný API klíč, žádný účet, nic se nikam nenahrává.