Čo je tento nástroj?
LLM API sa účtujú za token, nie za požiadavku — a vstupné tokeny (váš prompt, systémová správa, história konverzácie) sú cenené inak ako výstupné tokeny (to, čo model vygeneruje), zvyčajne s 4-8-násobnou prirážkou na výstup. Toto rozdelenie sťažuje odhad "koľko to bude stáť", najmä keď porovnávate modely naprieč dodávateľmi s rôznymi cenníkmi.
Táto kalkulačka vezme počet vašich vstupných a výstupných tokenov, vynásobí každý sadzbou vybraného modelu za milión tokenov a spočíta ich — presne tú istú matematiku, akú robí zúčtovací systém dodávateľa. Pridajte mesačný objem požiadaviek a kalkulačka vypočíta mesačnú sumu, čo sa hodí pri plánovaní rozpočtu ešte pred nasadením modelu do produkcie.
Prečo ho používať?
- 19 modelov od OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu a xAI — možnosti od lacných cez stredné až po vlajkové, vrátane hlavných čínskych model API a Groku.
- Porovnávacia tabuľka vedľa seba zoradí každý model podľa ceny pre vaše presné počty tokenov, takže nemusíte počítať každý ručne.
- Samostatné rozdelenie nákladov na vstup a výstup, keďže výstupné tokeny sú u každého dodávateľa cenené niekoľkonásobne vyššie ako vstupné.
- Voliteľný mesačný objem požiadaviek pre rýchlu projekciu rozpočtu, nie len odhad jednej požiadavky.
- Ceny overené priamo voči dokumentácii dodávateľov, s uvedeným dátumom overenia — nie stiahnuté ani odhadnuté.
- 100 % lokálne — žiadny API kľúč, žiadny účet, žiadne dáta neopúšťajú váš prehliadač.
Ako sa používa
- Vyberte model z rozbaľovacieho zoznamu, zoskupeného podľa dodávateľa (OpenAI / Anthropic / Google / DeepSeek / Qwen / Moonshot / Zhipu / xAI).
- Zadajte počet vstupných tokenov (prompt + systémová správa + akýkoľvek kontext) a očakávaný počet výstupných tokenov.
- Prečítajte si cenu za požiadavku, rozdelenú na náklady na vstup a výstup.
- Voliteľne zadajte počet požiadaviek za mesiac, aby ste videli odhadované mesačné náklady.
- Prejdite dole na porovnávaciu tabuľku, kde sú všetky modely zoradené podľa ceny pri rovnakom počte tokenov.
Príklad
Vstup
GPT-5.6 Terra, 1 000 vstupných tokenov, 500 výstupných tokenovVýstup
Cena za vstup 0,0025 $ + cena za výstup 0,0075 $ = 0,01 $ za požiadavkuPri 10 000 požiadavkách mesačne je to zhruba 100 $ mesačne — malé náklady za požiadavku sa v mierke rýchlo sčítajú, presne preto sa oplatí prepočítať si čísla ešte pred výberom modelu.
Pochopenie nákladov na vstup vs. výstup
Každý model v tomto zozname cení vstupné a výstupné tokeny samostatne a rozdiel medzi nimi je veľký a konzistentný naprieč dodávateľmi — výstup bežne stojí 5-6-násobne viac za token ako vstup. To znamená, že zhovorčivá, rozvláčna odpoveď modelu stojí neúmerne viac ako dlhý prompt s krátkou odpoveďou, aj keď celkový počet tokenov vyzerá podobne.
Praktický dôsledok: ak optimalizujete výdavky na API, skracovanie dĺžky výstupu (kratšie inštrukcie v systémovom prompte typu "odpovedz v jednom odseku") zvyčajne ušetrí viac ako skracovanie vstupu, token za token.
Približné mesačné náklady podľa vzoru používania
Toto sú ilustračné príklady, nie ponuky — použite kalkulačku vyššie s vlastnými počtami tokenov a výberom modelu pre presné číslo.
| Vzor používania | Typické tokeny/požiadavka | Príklad modelu | Približné mesačné náklady (10 tis. požiadaviek) |
|---|---|---|---|
| Krátke odpovede chatbota | 300 vstup / 150 výstup | GPT-5.4 Nano | ≈ 2-3 $/mesiac |
| Označovanie dát a klasifikácia | 500 vstup / 50 výstup | DeepSeek V4 Flash | ≈ 1 $/mesiac |
| Sumarizácia dokumentov | 3 000 vstup / 400 výstup | Claude Sonnet 5 | ≈ 100 $/mesiac |
| Asistent na generovanie kódu | 1 500 vstup / 1 000 výstup | Gemini 3.5 Flash | ≈ 110-115 $/mesiac |
| Tvorba dlhého textového obsahu | 1 000 vstup / 2 500 výstup | GPT-5.6 Sol | ≈ 800 $/mesiac |
Časté otázky
Prečo je výstup u každého modelu cenený oveľa vyššie ako vstup?
Generovanie tokenov (výstup) vyžaduje kompletný priechod modelom pre každý nový token, spúšťaný sekvenčne, zatiaľ čo spracovanie vstupných tokenov (prompt) je možné vykonať paralelne v jednej dávke. Táto asymetrická výpočtová náročnosť je dôvod, prečo každý veľký dodávateľ cení výstup zhruba 4-8-násobne vyššie ako vstup.
Ako zistím, koľko tokenov môj prompt spotrebuje?
Použite nástroj Token Counter od CodeKitHub — vložte svoj skutočný prompt alebo systémovú správu a uvidíte presný počet tokenov pomocou skutočného tokenizéra, namiesto hrubého odhadu podľa počtu znakov. Počet výstupných tokenov je vopred ťažšie predvídať; rozumný postup je skontrolovať skutočné využitie z niekoľkých reálnych odpovedí API a použiť to ako odhad.
Sú tieto ceny zaručene aktuálne?
Nie — ceny API dodávateľov AI sa menia pomerne často, niekedy s malým predstihom. Ceny v tomto nástroji boli overené priamo voči oficiálnej cenníkovej stránke každého dodávateľa v deň uvedený pri kalkulačke. Pred rozhodnutím o rozpočte alebo nákupe si overte aktuálnu stránku sami: cenník OpenAI (developers.openai.com/api/docs/pricing), cenník Anthropic/Claude (platform.claude.com/docs/en/about-claude/pricing) a cenník Google Gemini (ai.google.dev/gemini-api/docs/pricing).
Prečo tam nie je [môj obľúbený model]?
Tento nástroj pokrýva reprezentatívny výber lacných, stredných a vlajkových modelov od OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu a xAI (spolu 19 modelov), nie každý model, ktorý každý dodávateľ ponúka, aby zoznam zostal prehľadný a cenové dáta ľahko udržateľné a presné. Ak potrebujete model, ktorý tam nie je uvedený, skontrolujte jeho cenu za 1M tokenov na stránke dodávateľa a urobte rovnaký výpočet nákladov na vstup a výstup ručne.
Zohľadňuje cena Gemini 3.1 Pro Preview dlhé prompty?
Nie — zobrazená cena je Googlom stanovená úroveň pre ≤ 200 000 tokenov. Cenník Gemini sa pri promptoch dlhších ako táto hranica zvyšuje a táto kalkulačka tento príplatkový stupeň nemodeluje, aby zostal nástroj jednoduchý. Ak vaše prompty pravidelne prekračujú 200 tisíc tokenov, skontrolujte na cenníkovej stránke Googlu presnú sadzbu pre dlhý kontext.
Sú ceny DeepSeek, Qwen, Kimi a GLM v USD?
Áno — všetky ceny v tomto nástroji, vrátane čínskych modelov, sú oficiálne medzinárodné sadzby API v USD, takže každý model možno porovnávať na rovnakom základe. Niektorí z týchto dodávateľov ponúkajú aj konzoly zúčtované v CNY pre účty z pevninskej Číny s inými (často nižšími) sadzbami; ak fakturujete v CNY, skontrolujte vlastnú konzolu dodávateľa.
Mám optimalizovať náklady na vstup, alebo na výstup?
Zamerajte sa na tvar vašej záťaže. Ak je náročná na vstup — dlhé dokumenty na vstupe, krátke odpovede na výstupe (klasifikácia, extrakcia, RAG) — dominujú vašim nákladom ceny za vstup a cache promptov. Ak je náročná na výstup — dlhé generovania z krátkych promptov — najviac záleží na cene za výstup, a výstupné tokeny bežne stoja niekoľkonásobne viac za token ako vstupné pri tom istom modeli.