CodeKitHub
Nejlevnější LLM API v roce 2026: kompletní srovnání cen, 19 modelů

Nejlevnější LLM API v roce 2026: kompletní srovnání cen, 19 modelů

Publikováno 25. 7. 2026

Pokud vybíráte LLM API čistě podle ceny, rozptyl je větší, než většina lidí čeká. Při srovnání všech 19 modelů, které sleduje zdejší LLM API Pricing Calculator — OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot/Kimi, Zhipu/GLM a xAI — se nejlevnější a nejdražší model při srovnatelném zatížení liší více než 60násobně. Tenhle rozdíl je mnohem důležitější než to, na čí logo jste zvyklí.

Žebříček

Aby bylo srovnání férové, každý model níže je hodnocen podle kombinované sazby: 750 000 vstupních tokenů + 250 000 výstupních tokenů na 1M celkových tokenů, což zhruba odpovídá typickému chatovému požadavku, kde je odpověď kratší než prompt. Ceny jsou za 1M tokenů a jsou ověřené proti oficiálním ceníkům jednotlivých poskytovatelů.

Pořadí Model Poskytovatel Vstup Výstup Kombinovaná (3:1)
1 Gemini 2.5 Flash-Lite Google $0.10 $0.40 $0.175
1 DeepSeek V4 Flash DeepSeek $0.14 $0.28 $0.175
3 Qwen3.6 Flash Qwen $0.19 $1.13 $0.42
4 GPT-5.4 Nano OpenAI $0.20 $1.25 $0.46
5 DeepSeek V4 Pro DeepSeek $0.44 $0.87 $0.54
6 Grok Code Fast 1 xAI $1.00 $2.00 $1.25
7 GPT-5.4 Mini OpenAI $0.75 $4.50 $1.69
8 Claude Haiku 4.5 Anthropic $1.00 $5.00 $2.00
9 GLM-5.2 Zhipu $1.40 $4.40 $2.15
10 GPT-5.6 Luna OpenAI $1.00 $6.00 $2.25
11 Grok 4.5 xAI $2.00 $6.00 $3.00
12 Gemini 3.5 Flash Google $1.50 $9.00 $3.38
13 Qwen3.7 Max Qwen $2.50 $7.50 $3.75
14 Claude Sonnet 5 Anthropic $2.00 $10.00 $4.00
15 Gemini 3.1 Pro Preview Google $2.00 $12.00 $4.50
16 GPT-5.6 Terra OpenAI $2.50 $15.00 $5.63
17 Kimi K3 Moonshot $3.00 $15.00 $6.00
18 Claude Opus 5 Anthropic $5.00 $25.00 $10.00
19 GPT-5.6 Sol OpenAI $5.00 $30.00 $11.25

Několik věcí stojí za pozornost. Každý poskytovatel — ne jen jeden — má jak rozpočtovou, tak vlajkovou řadu, které se od sebe liší několikanásobně, takže otázka „který dodavatel je nejlevnější“ je špatně položená; správná otázka zní „který konkrétní model“. Za druhé, dva nejlevnější modely (Gemini 2.5 Flash-Lite a DeepSeek V4 Flash) končí na naprosto stejné kombinované sazbě, přestože pocházejí od nesouvisejících firem — na úplně spodním konci se ceny rozpočtové úrovně sblížily, místo aby jeden dodavatel podrážel ostatní.

Proč nejlevnější model není automaticky ta správná volba

Cena sama o sobě neříká, jestli je model pro vaši úlohu dost dobrý. Rozpočtové modely obvykle stačí na klasifikaci, extrakci, krátké odpovědi a další úzce vymezené úlohy — tedy práci, kde by extra schopnosti vlajkového modelu zůstaly nevyužité. Hůř se hodí na otevřené uvažování, dlouhé vícekrokové agentní workflow nebo úlohy, kde je špatná odpověď drahá na pozdější odhalení; levnější model, který úlohu zkazí a potřebuje opakovaný pokus (nebo lidskou opravu), může nakonec stát víc než dražší model, který ji zvládne napoprvé.

Rozumný výchozí postup: prototypujte s modelem, který znáte nejlépe, a jakmile je úloha dobře definovaná, otestujte, jestli rozpočtový model ze stejné tabulky dává přijatelně podobný výstup — pokud ano, úspory se ve velkém měřítku sčítají; pokud ne, cenový rozdíl stejně nebyl tím skutečným nákladovým faktorem.

Jak zjistit své skutečné číslo

Tabulka používá pevný poměr 3:1, aby šlo modely vůbec seřadit, ale váš reálný poměr vstupních a výstupních tokenů skoro jistě 3:1 není — sumarizace může být 10:1, generování kódu spíš 1:2. Kombinované pořadí výše je rozumný výchozí bod pro výběr kandidátů k otestování, ne náhrada za výpočet vašich konkrétních nákladů.

K tomu použijte přímo LLM API Pricing Calculator: zadejte skutečné počty vstupních a výstupních tokenů a nástroj spočítá přesnou cenu pro kterýkoli z těchto 19 modelů, plus měsíční odhad, pokud zhruba víte, kolik požadavků uděláte. Pokud počty tokenů zatím neznáte, nástroj Token Counter vám dá skutečné číslo z reálného promptu místo hrubého odhadu. Oba běží kompletně ve vašem prohlížeči — žádný API klíč, žádný účet, nic se nikam nenahrává.

← Zpět na blog