CodeKitHub
Orodja za umetno inteligenco

Kalkulator cen LLM API

Nazadnje posodobljeno:

Izberi model, vnesi število vhodnih in izhodnih žetonov ter poglej natančno ceno na zahtevo — poleg tega tudi oceno mesečnih stroškov, če približno veš, koliko zahtev boš izvedel. Primerjalna tabela spodaj razvrsti vseh 19 modelov po ceni za enako število žetonov, tako da na prvi pogled vidiš, ali je za tvojo obremenitev najcenejši GPT, Claude, Gemini, DeepSeek, Qwen, Kimi, GLM ali Grok. Zajema trenutne modele podjetij OpenAI, Anthropic, Google, DeepSeek, Qwen (Alibaba), Moonshot (Kimi), Zhipu (GLM) in xAI (Grok), s cenami, preverjenimi neposredno na uradni cenovni strani vsakega ponudnika. Vse teče lokalno v tvojem brskalniku.

Prices last verified: August 17, 2026

AI vendor API pricing changes frequently — these figures are for reference only. Check the vendor's official pricing page before making budget or purchasing decisions.

Kaj je to orodje?

LLM API-ji se zaračunavajo po žetonu, ne po zahtevi — vhodni žetoni (tvoj poziv, sistemsko sporočilo, zgodovina pogovora) pa so cenovno ločeni od izhodnih žetonov (kar model ustvari), običajno z 4-8-kratnim pribitkom za izhod. Ta razdelitev otežuje oceno stroškov na prvi pogled, še posebej ko primerjaš modele različnih ponudnikov z različnimi cenami.

Ta kalkulator vzame tvoje število vhodnih in izhodnih žetonov, vsakega pomnoži z ceno izbranega modela na milijon žetonov in ju sešteje — enak izračun uporablja tudi obračunski sistem ponudnika. Dodaj mesečno količino zahtev in izračuna mesečni skupni znesek, kar je uporabno za načrtovanje proračuna, preden se odločiš za model v produkciji.

Zakaj ga uporabiti?

  • 19 modelov ponudnikov OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu in xAI — proračunske, srednje in vodilne možnosti, vključno z največjimi kitajskimi model API-ji in Grokom.
  • Primerjalna tabela drug ob drugem razvrsti vsak model po ceni za tvoje natančno število žetonov, tako da ti ni treba računati vsakega ročno.
  • Ločen prikaz stroškov vhoda in izhoda, saj so izhodni žetoni pri vsakem ponudniku cenovno večkrat višji od vhodnih.
  • Neobvezna mesečna količina zahtev za hitro projekcijo proračuna, ne le oceno ene same zahteve.
  • Cene preverjene neposredno na dokumentaciji ponudnikov, s prikazanim datumom preverjanja — ne strgane ali ocenjene.
  • 100 % lokalno — brez API ključa, brez računa, brez podatkov, ki bi zapustili tvoj brskalnik.

Kako ga uporabljati

  1. Izberi model iz spustnega seznama, razvrščenega po ponudniku (OpenAI / Anthropic / Google / DeepSeek / Qwen / Moonshot / Zhipu / xAI).
  2. Vnesi število vhodnih žetonov (poziv + sistemsko sporočilo + morebiten kontekst) in pričakovano število izhodnih žetonov.
  3. Preberi ceno na zahtevo, razdeljeno na strošek vhoda in strošek izhoda.
  4. Po želji vnesi število zahtev na mesec za oceno mesečnega stroška.
  5. Pomakni se navzdol do primerjalne tabele, da vidiš vse modele razvrščene po ceni za enako število žetonov.

Primer

Vnos

GPT-5.6 Terra, 1.000 vhodnih žetonov, 500 izhodnih žetonov

Rezultat

Strošek vhoda 0,0025 $ + strošek izhoda 0,0075 $ = 0,01 $ na zahtevo

Pri 10.000 zahtevah na mesec je to približno 100 $ mesečno — majhni stroški na zahtevo se pri obsegu hitro seštejejo, zato je preverjanje računice pred izbiro modela pomembno.

Razumevanje stroška vhoda proti izhodu

Vsak model na tem seznamu cenovno ločeno obravnava vhodne in izhodne žetone, razlika med njima pa je velika in dosledna pri vseh ponudnikih — izhod redno stane 5-6-krat več na žeton kot vhod. To pomeni, da klepetav, obsežen odgovor modela stane nesorazmerno več kot dolg poziv s kratkim odgovorom, tudi če je skupno število žetonov podobno.

Praktična posledica: če optimiziraš porabo na API-ju, skrajšanje dolžine izhoda (krajša navodila v sistemskem pozivu, kot je "odgovori v enem odstavku") običajno prihrani več kot skrajšanje vhoda, žeton za žeton.

Grobi mesečni stroški po vzorcih uporabe

To so ponazoritveni primeri, ne ponudbe — za natančno številko uporabi zgornji kalkulator s svojim številom žetonov in izbiro modela.

Vzorec uporabeTipični žetoni/zahtevoPrimer modelaGrobi mesečni strošek (10 tisoč zahtev)
Kratki odgovori chatbota300 noter / 150 venGPT-5.4 Nano≈ 2-3 $/mesec
Označevanje in klasifikacija podatkov500 noter / 50 venDeepSeek V4 Flash≈ 1 $/mesec
Povzemanje dokumentov3.000 noter / 400 venClaude Sonnet 5≈ 100 $/mesec
Pomočnik za generiranje kode1.500 noter / 1.000 venGemini 3.5 Flash≈ 110-115 $/mesec
Pisanje daljših besedil1.000 noter / 2.500 venGPT-5.6 Sol≈ 800 $/mesec

Pogosta vprašanja

Zakaj je izhod pri vsakem modelu cenovno tako veliko dražji od vhoda?

Ustvarjanje žetonov (izhod) zahteva poln prehod skozi model za vsak nov žeton, izveden zaporedno, medtem ko je obdelavo vhodnih žetonov (poziva) mogoče izvesti vzporedno v eni sami paketni obdelavi. Ta asimetrija v porabi računske moči je razlog, da vsi večji ponudniki izhod cenijo približno 4-8-krat višje od vhoda.

Kako vem, koliko žetonov bo porabil moj poziv?

Uporabi orodje CodeKitHub Token Counter — prilepi svoj dejanski poziv ali sistemsko sporočilo in prikaže natančno število žetonov z uporabo pravega tokenizerja, namesto grobe ocene na podlagi znakov. Število izhodnih žetonov je težje vnaprej napovedati; smiseln pristop je preveriti dejansko porabo iz nekaj resničnih odgovorov API-ja in to uporabiti kot oceno.

Ali so te cene zagotovo trenutne?

Ne — cene API-jev ponudnikov AI se precej pogosto spreminjajo, včasih brez veliko opozorila. Cene v tem orodju so bile preverjene neposredno na uradni cenovni strani vsakega ponudnika na dan, prikazan blizu kalkulatorja. Pred sprejemom proračunske ali nakupne odločitve preveri trenutno stran sam: cenik OpenAI (developers.openai.com/api/docs/pricing), cenik Anthropic/Claude (platform.claude.com/docs/en/about-claude/pricing) in cenik Google Gemini (ai.google.dev/gemini-api/docs/pricing).

Zakaj na seznamu ni [mojega priljubljenega modela]?

To orodje pokriva reprezentativen razpon proračunskih, srednjih in vodilnih modelov ponudnikov OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu in xAI (skupaj 19 modelov), namesto vsakega modela, ki ga posamezen ponudnik ponuja, da seznam ostane pregleden, cenovni podatki pa lažje ažurni. Če potrebuješ model, ki ni na seznamu, preveri njegovo ceno na 1 milijon žetonov na strani ponudnika in enako izračunaj strošek vhoda in izhoda ročno.

Ali cena za Gemini 3.1 Pro Preview upošteva dolge pozive?

Ne — prikazana cena je Googlov nivo do 200.000 žetonov. Cena Gemini se za pozive nad tem pragom poviša, ta kalkulator pa te dodatne stopnje ne modelira, da ostane orodje preprosto. Če tvoji pozivi redno presegajo 200 tisoč žetonov, preveri natančno ceno za dolg kontekst na Googlovi cenovni strani.

Ali so cene DeepSeek, Qwen, Kimi in GLM v USD?

Da — vse cene v tem orodju, vključno s kitajskimi modeli, so uradne mednarodne API cene v USD, tako da je vsak model mogoče primerjati na enaki osnovi. Nekateri od teh ponudnikov ponujajo tudi konzole z obračunavanjem v CNY za račune iz celinske Kitajske po drugačnih (pogosto nižjih) cenah; če obračunavaš v CNY, preveri konzolo ponudnika.

Ali naj optimiziram strošek vhoda ali izhoda?

Poglej naravo svoje obremenitve. Če je pretežno vhodna — dolgi dokumenti noter, kratki odgovori ven (klasifikacija, ekstrakcija, RAG) — prevladujeta cena vhoda in predpomnjenje pozivov. Če je pretežno izhodna — dolge generacije iz kratkih pozivov — je najpomembnejša cena izhoda, izhodni žetoni pa pri istem modelu na žeton praviloma stanejo večkrat več kot vhodni.

Sorodna orodja