CodeKitHub
AI nástroje

Kalkulačka cen API LLM

Naposledy aktualizováno:

Vyberte model, zadejte počet vstupních a výstupních tokenů a uvidíte přesnou cenu za požadavek — plus odhad měsíčních nákladů, pokud přibližně víte, kolik požadavků uděláte. Srovnávací tabulka níže seřazuje všech 19 modelů podle ceny pro stejný počet tokenů, takže na první pohled uvidíte, zda je pro vaši zátěž nejlevnější GPT, Claude, Gemini, DeepSeek, Qwen, Kimi, GLM nebo Grok. Pokrývá aktuální modely od OpenAI, Anthropic, Google, DeepSeek, Qwen (Alibaba), Moonshot (Kimi), Zhipu (GLM) a xAI (Grok), přičemž ceny jsou ověřeny přímo podle oficiální ceníkové stránky každého poskytovatele. Vše běží lokálně ve vašem prohlížeči.

Prices last verified: August 17, 2026

AI vendor API pricing changes frequently — these figures are for reference only. Check the vendor's official pricing page before making budget or purchasing decisions.

Co je tento nástroj?

API LLM se účtují za token, ne za požadavek — a vstupní tokeny (váš prompt, systémová zpráva, historie chatu) mají jinou cenu než výstupní tokeny (to, co model vygeneruje), obvykle s 4–8násobnou přirážkou na výstup. Toto rozdělení dělá otázku „kolik to bude stát“ obtížně odhadnutelnou od oka, obzvlášť pokud porovnáváte modely napříč poskytovateli s odlišnými ceníky.

Tato kalkulačka vezme počet vašich vstupních a výstupních tokenů, každý vynásobí sazbou vybraného modelu za milion tokenů a výsledky sečte — přesně stejný výpočet, jaký provádí fakturační systém poskytovatele. Přidejte měsíční objem požadavků a kalkulačka spočítá odhadovaný měsíční součet, což se hodí při plánování rozpočtu předtím, než se zavážete k modelu v produkci.

Proč ho používat?

  • 19 modelů napříč OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu a xAI — rozpočtové, středněpásmové a vlajkové možnosti, včetně hlavních čínských model API a Grok.
  • Srovnávací tabulka vedle sebe seřazuje každý model podle ceny pro váš přesný počet tokenů, takže nemusíte počítat každý ručně.
  • Samostatné rozdělení nákladů na vstup/výstup, protože výstupní tokeny mají u každého poskytovatele několikrát vyšší cenu než vstupní.
  • Volitelný měsíční objem požadavků pro rychlý odhad rozpočtu, nejen odhad pro jeden požadavek.
  • Ceny ověřené přímo podle dokumentace poskytovatelů, se zobrazeným datem ověření — nikoli stažené webscrapingem nebo odhadnuté.
  • 100% lokální — žádný API klíč, žádný účet, žádná data neopouští váš prohlížeč.

Jak se používá

  1. Vyberte model z rozbalovací nabídky, seskupené podle poskytovatele (OpenAI / Anthropic / Google / DeepSeek / Qwen / Moonshot / Zhipu / xAI).
  2. Zadejte počet vstupních tokenů (prompt + systémová zpráva + jakýkoli kontext) a očekávaný počet výstupních tokenů.
  3. Přečtěte si cenu za požadavek, rozdělenou na náklady na vstup a náklady na výstup.
  4. Volitelně zadejte počet požadavků za měsíc pro odhad měsíčních nákladů.
  5. Přejděte dolů na srovnávací tabulku a uvidíte všechny modely seřazené podle ceny pro stejný počet tokenů.

Příklad

Vstup

GPT-5.6 Terra, 1 000 vstupních tokenů, 500 výstupních tokenů

Výstup

Náklady na vstup 0,0025 $ + náklady na výstup 0,0075 $ = 0,01 $ za požadavek

Při 10 000 požadavcích měsíčně je to zhruba 100 $ měsíčně — malé náklady na požadavek se ve velkém měřítku rychle sčítají, a přesně proto je důležité kontrolovat výpočet ještě před výběrem modelu.

Pochopení nákladů na vstup vs. výstup

Každý model v tomto seznamu cení vstupní a výstupní tokeny samostatně a rozdíl mezi nimi je velký a napříč poskytovateli konzistentní — výstup běžně stojí 5–6× více za token než vstup. To znamená, že upovídaná, rozvláčná odpověď modelu stojí neúměrně více než dlouhý prompt s krátkou odpovědí, i když celkový počet tokenů vypadá podobně.

Praktický důsledek: pokud optimalizujete výdaje na API, zkrácení délky výstupu (kratší instrukce v systémovém promptu jako „odpověz v jednom odstavci“) obvykle ušetří více než zkrácení vstupu, token za token.

Přibližné měsíční náklady podle vzorce použití

Toto jsou ilustrativní příklady, nikoli nabídky — pro přesné číslo použijte výše uvedenou kalkulačku s vlastním počtem tokenů a výběrem modelu.

Vzorec použitíTypické tokeny/požadavekPříklad modeluPřibližné měsíční náklady (10 tis. požadavků)
Krátké odpovědi chatbota300 vstup / 150 výstupGPT-5.4 Nano≈ 2–3 $/měsíc
Označování a klasifikace dat500 vstup / 50 výstupDeepSeek V4 Flash≈ 1 $/měsíc
Sumarizace dokumentů3 000 vstup / 400 výstupClaude Sonnet 5≈ 100 $/měsíc
Asistent pro generování kódu1 500 vstup / 1 000 výstupGemini 3.5 Flash≈ 110–115 $/měsíc
Tvorba dlouhého obsahu1 000 vstup / 2 500 výstupGPT-5.6 Sol≈ 800 $/měsíc

Časté dotazy

Proč je výstup u každého modelu ceněný tak mnohem výše než vstup?

Generování tokenů (výstup) vyžaduje kompletní dopředný průchod modelem pro každý nový token, spuštěný sekvenčně, zatímco zpracování vstupních tokenů (promptu) lze provést paralelně v jedné dávce. Tento asymetrický výpočetní náklad je důvodem, proč každý hlavní poskytovatel cení výstup zhruba na 4–8násobek vstupní sazby.

Jak zjistím, kolik tokenů můj prompt spotřebuje?

Použijte nástroj Token Counter od CodeKitHub — vložte svůj skutečný prompt nebo systémovou zprávu a zobrazí přesný počet tokenů pomocí skutečného tokenizéru, nikoli hrubý odhad založený na počtu znaků. Počet výstupních tokenů je předem obtížnější odhadnout; rozumným přístupem je zkontrolovat skutečné využití u několika reálných odpovědí API a použít to jako svůj odhad.

Jsou tyto ceny garantovaně aktuální?

Ne — ceny API poskytovatelů AI se mění poměrně často, někdy s malým předstihem oznámení. Ceny v tomto nástroji byly ověřeny přímo podle oficiální ceníkové stránky každého poskytovatele k datu zobrazenému u kalkulačky. Před rozhodnutím o rozpočtu nebo nákupu si sami zkontrolujte aktuální stránku: ceny OpenAI (developers.openai.com/api/docs/pricing), ceny Anthropic/Claude (platform.claude.com/docs/en/about-claude/pricing) a ceny Google Gemini (ai.google.dev/gemini-api/docs/pricing).

Proč v seznamu není [můj oblíbený model]?

Tento nástroj pokrývá reprezentativní rozsah rozpočtových / středněpásmových / vlajkových modelů od OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu a xAI (celkem 19 modelů) místo úplně každého modelu, který každý poskytovatel nabízí, aby seznam zůstal přehledný a cenová data snadno udržovatelná v přesnosti. Pokud potřebujete model, který v seznamu není, zkontrolujte jeho cenu za 1M tokenů na stránce poskytovatele a proveďte stejný výpočet nákladů na vstup a výstup ručně.

Zohledňuje cena Gemini 3.1 Pro Preview dlouhé prompty?

Ne — zobrazená cena je Google úroveň pro ≤200 000 tokenů. Ceny Gemini se pro prompty delší než tento práh zvyšují a tato kalkulačka tuto úroveň příplatku nemodeluje, aby zůstal nástroj jednoduchý. Pokud vaše prompty pravidelně přesahují 200 tisíc tokenů, zkontrolujte na stránce Google přesnou sazbu pro dlouhý kontext.

Jsou ceny DeepSeek, Qwen, Kimi a GLM v USD?

Ano — všechny ceny v tomto nástroji, včetně čínských modelů, jsou oficiální mezinárodní API sazby v USD, takže lze každý model porovnávat na stejném základě. Někteří z těchto poskytovatelů nabízejí také konzole fakturované v CNY pro účty z pevninské Číny za jiné (často nižší) sazby; pokud fakturujete v CNY, zkontrolujte vlastní konzoli poskytovatele.

Mám optimalizovat náklady na vstup, nebo na výstup?

Podívejte se na povahu vaší zátěže. Pokud je náročná na vstup — dlouhé dokumenty na vstupu, krátké odpovědi na výstupu (klasifikace, extrakce, RAG) — dominuje vaší faktuře cena vstupu a cachování promptů. Pokud je náročná na výstup — dlouhé generace z krátkých promptů — nejvíce záleží na ceně výstupu, přičemž výstupní tokeny u stejného modelu obvykle stojí za token několikanásobně více než vstupní.

Související nástroje