Mis see tööriist on?
LLM API-sid arveldatakse tokeni, mitte päringu kaupa — ja sisendtokenid (sinu viip, süsteemisõnum, vestlusajalugu) on hinnastatud teisiti kui väljundtokenid (see, mida mudel genereerib), tavaliselt 4-8-kordse juurdehindlusega väljundile. See jaotus muudab "kui palju see maksma läheb" silma järgi raskesti hinnatavaks, eriti kui võrdled mudeleid erinevate hinnakirjadega pakkujate lõikes.
See kalkulaator võtab sinu sisend- ja väljundtokenite arvu, korrutab kummagi valitud mudeli miljoni-tokeni hinnaga ja liidab need kokku — täpselt sama arvutus, mida teeb pakkuja arveldussüsteem. Lisa kuine päringute maht ja see prognoosib kuukulu, mis on kasulik eelarve koostamisel enne mudeli tootmisse võtmist.
Miks seda kasutada?
- 19 mudelit OpenAI, Anthropicu, Google'i, DeepSeeki, Qweni, Moonshoti, Zhipu ja xAI lõikes — eelarve-, keskklassi- ja lipulaevavariandid, sealhulgas suuremad Hiina mudeli API-d ja Grok.
- Kõrvuti võrdlustabel järjestab iga mudeli kulu järgi sinu täpsete tokenite arvude juures, nii et sul pole vaja igaüht käsitsi arvutada.
- Eraldi sisendi/väljundi kulude jaotus, kuna väljundtokenid on iga pakkuja juures mitmekordselt kallimad kui sisendtokenid.
- Valikuline kuine päringumaht kiire eelarveprognoosi jaoks, mitte ainult ühe päringu hinnang.
- Hinnad kontrollitud otse pakkuja dokumentatsioonist, koos kontrollimise kuupäevaga — mitte kraabitud ega hinnangulised.
- 100% kohalik — API-võtit ei ole vaja, kontot ei ole vaja, ükski andmed ei lahku sinu brauserist.
Kuidas kasutada
- Vali mudel rippmenüüst, rühmitatud pakkuja järgi (OpenAI / Anthropic / Google / DeepSeek / Qwen / Moonshot / Zhipu / xAI).
- Sisesta oma sisendtokenite arv (viip + süsteemisõnum + mis tahes kontekst) ja oodatav väljundtokenite arv.
- Loe kulu päringu kohta, jagatuna sisendi kuluks ja väljundi kuluks.
- Sisesta vabatahtlikult päringute arv kuus, et näha hinnangulist kuukulu.
- Keri alla võrdlustabelisse, et näha kõiki mudeleid järjestatuna kulu järgi samade tokenite arvude juures.
Näide
Sisend
GPT-5.6 Terra, 1000 sisendtokenit, 500 väljundtokenitTulemus
Sisendi kulu 0,0025 $ + väljundi kulu 0,0075 $ = 0,01 $ päringu kohta10 000 päringu juures kuus on see umbes 100 $ kuus — väikesed kulud päringu kohta kasvavad mastaabis kiiresti, mistõttu on arvutuse kontrollimine enne mudeli valimist just seetõttu oluline.
Sisendi vs väljundi kulu mõistmine
Iga selle nimekirja mudel hinnastab sisend- ja väljundtokenid eraldi, ja nendevaheline lõhe on suur ja järjekindel kõigi pakkujate lõikes — väljund maksab regulaarselt 5-6 korda rohkem tokeni kohta kui sisend. See tähendab, et jutukas, sõnaohter mudeli vastus maksab ebaproportsionaalselt rohkem kui pikk viip lühikese vastusega, isegi kui tokenite kogusumma näib sarnane.
Praktiline järeldus: kui optimeerid API-kulusid, säästab väljundi pikkuse kärpimine (lühemad süsteemi-viiba juhised nagu "vasta ühes lõigus") tokeni kohta tavaliselt rohkem kui sisendi kärpimine.
Umbkaudne kuukulu kasutusmustri järgi
Need on illustratiivsed näited, mitte pakkumised — kasuta ülaltoodud kalkulaatorit oma tokenite arvude ja mudelivalikuga täpse numbri saamiseks.
| Kasutusmuster | Tüüpiline tokenite arv päringu kohta | Näidismudel | Umbkaudne kuukulu (10k päringut) |
|---|---|---|---|
| Lühikesed vestlusroboti vastused | 300 sisse / 150 välja | GPT-5.4 Nano | ≈ 2-3 $/kuus |
| Andmete märgistamine ja klassifitseerimine | 500 sisse / 50 välja | DeepSeek V4 Flash | ≈ 1 $/kuus |
| Dokumentide kokkuvõtmine | 3000 sisse / 400 välja | Claude Sonnet 5 | ≈ 100 $/kuus |
| Koodigeneraatori assistent | 1500 sisse / 1000 välja | Gemini 3.5 Flash | ≈ 110-115 $/kuus |
| Pikavormilise sisu koostamine | 1000 sisse / 2500 välja | GPT-5.6 Sol | ≈ 800 $/kuus |
Korduma kippuvad küsimused
Miks on väljund iga mudeli puhul nii palju kallim kui sisend?
Tokenite genereerimine (väljund) nõuab iga uue tokeni jaoks täielikku edasiläbimist mudelist, mis toimub järjestikku, samas kui sisendtokenite (viiba) töötlemist saab teha paralleelselt ühe partiina. Just see asümmeetriline arvutuskulu on põhjus, miks iga suurem pakkuja hinnastab väljundi umbes 4-8 korda kõrgemalt kui sisendi.
Kuidas ma tean, mitu tokenit mu viip kasutab?
Kasuta CodeKitHubi Token Counter tööriista — kleebi oma tegelik viip või süsteemisõnum ja see näitab täpset tokenite arvu tegeliku tokeniseerija abil, mitte umbkaudset märgipõhist oletust. Väljundtokenite arvu on ette raskem ennustada; mõistlik lähenemine on kontrollida tegelikku kasutust mõne päris API-vastuse põhjal ja kasutada seda hinnanguna.
Kas need hinnad on kindlasti ajakohased?
Ei — tehisintellekti pakkujate API hinnad muutuvad üsna sageli, mõnikord vähese ette hoiatusega. Selle tööriista hinnad on kontrollitud otse iga pakkuja ametlikult hinnalehelt kalkulaatori juures näidatud kuupäeval. Enne eelarve- või ostuotsuse tegemist kontrolli ise praegust lehte: OpenAI hinnakiri (developers.openai.com/api/docs/pricing), Anthropic/Claude hinnakiri (platform.claude.com/docs/en/about-claude/pricing) ja Google Gemini hinnakiri (ai.google.dev/gemini-api/docs/pricing).
Miks [minu lemmikmudelit] nimekirjas ei ole?
See tööriist katab esindusliku eelarve-/keskklassi-/lipulaevavaliku OpenAI-lt, Anthropicult, Google'ilt, DeepSeekilt, Qwenilt, Moonshotilt, Zhipult ja xAI-lt (kokku 19 mudelit), mitte iga mudelit, mida iga pakkuja pakub, et hoida nimekiri kergesti sirvitav ja hinnaandmed lihtsalt täpsena hoitavad. Kui vajad mudelit, mida nimekirjas ei ole, kontrolli selle hinda 1M tokeni kohta pakkuja lehel ja tee sama sisendi-kulu + väljundi-kulu arvutus käsitsi.
Kas Gemini 3.1 Pro Preview hind arvestab pikkade viipadega?
Ei — näidatud hind on Google'i ≤200 000-tokenilise astme hind. Gemini hind tõuseb sellest lävest pikemate viipade puhul, ja see kalkulaator ei modelleeri seda lisatasu astet, et hoida tööriist lihtsana. Kui su viibad ületavad regulaarselt 200 000 tokenit, kontrolli Google'i hinnalehelt täpset pikakontekstihinda.
Kas DeepSeeki, Qweni, Kimi ja GLM hinnad on USA dollarites?
Jah — kõik selle tööriista hinnad, sealhulgas Hiina mudelid, on ametlikud rahvusvahelised API-hinnad USA dollarites, nii et iga mudelit saab võrrelda samal alusel. Mõned neist pakkujatest pakuvad ka jüaanides arveldatavaid konsoole Mandri-Hiina kontode jaoks erinevate (sageli madalamate) hindadega; kontrolli pakkuja enda konsooli, kui arveldad jüaanides.
Kas peaksin optimeerima sisendi kulu või väljundi kulu?
Vaata oma töökoormuse kuju. Kui see on sisendiraske — pikad dokumendid sisse, lühikesed vastused välja (klassifitseerimine, väljavõtmine, RAG) — domineerivad su arves sisendi hind ja viiba vahemällu salvestamine. Kui see on väljundiraske — pikad genereeringud lühikestest viipadest — on kõige olulisem väljundi hind, ja väljundtokenid maksavad tavaliselt sama mudeli juures tokeni kohta mitu korda rohkem kui sisend.