Mikä tämä työkalu on?
LLM-API:t laskutetaan tokeneittain, ei pyynnöittäin — ja syötetokenit (kehotteesi, järjestelmäviesti, keskusteluhistoria) hinnoitellaan eri tavalla kuin tulostetokenit (mallin tuottama sisältö), yleensä 4–8-kertaisella hinnankorotuksella tulosteelle. Tuo jako tekee "paljonko tämä maksaa" vaikeasti arvioitavaksi, varsinkin kun vertailet malleja eri toimittajien välillä erilaisin hintakortein.
Tämä laskuri ottaa syöte- ja tulostetokeniesi määrän, kertoo kummankin valitun mallin miljoonaa tokenia kohden lasketulla hinnalla ja laskee ne yhteen — samaa matematiikkaa, jota toimittajan laskutusjärjestelmä käyttää. Lisää kuukausittainen pyyntömäärä, ja se ennustaa kuukausikokonaissumman, hyödyllistä budjetointiin ennen kuin sitoudut malliin tuotannossa.
Miksi käyttää sitä?
- 19 mallia OpenAI:lta, Anthropicilta, Googlelta, DeepSeekiltä, Qwenilta, Moonshotilta, Zhipulta ja xAI:lta — budjetti-, keski- ja lippulaivavaihtoehtoja, mukaan lukien merkittävät kiinalaiset malli-API:t ja Grok.
- Rinnakkainen vertailutaulukko järjestää jokaisen mallin hinnan mukaan tarkoilla tokenmäärilläsi, joten sinun ei tarvitse laskea jokaista käsin.
- Erillinen syöte-/tulostekustannuserittely, koska tulostetokenit hinnoitellaan moninkertaisesti kalliimmiksi kuin syötetokenit jokaisella toimittajalla.
- Valinnainen kuukausittainen pyyntömäärä nopeaan budjettiennusteeseen, ei vain yhden pyynnön arvioon.
- Hinnat vahvistettu suoraan toimittajien dokumentaatiosta, vahvistuspäivämäärä näkyvissä — ei kaavittu tai arvioitu.
- 100 % paikallinen — ei API-avainta, ei tiliä, mitään dataa ei poistu selaimestasi.
Käyttöohje
- Valitse malli pudotusvalikosta, ryhmiteltynä toimittajan mukaan (OpenAI / Anthropic / Google / DeepSeek / Qwen / Moonshot / Zhipu / xAI).
- Syötä syötetokenien määrä (kehote + järjestelmäviesti + mahdollinen konteksti) ja odotettu tulostetokenien määrä.
- Lue hinta per pyyntö, eriteltynä syöte- ja tulostekustannukseen.
- Syötä valinnaisesti pyynnöt kuukaudessa nähdäksesi arvioidun kuukausihinnan.
- Vieritä alas vertailutaulukkoon nähdäksesi jokaisen mallin järjestettynä hinnan mukaan samoilla tokenmäärillä.
Esimerkki
Syöte
GPT-5.6 Terra, 1 000 syötetokenia, 500 tulostetokeniaTuloste
Syötekustannus 0,0025 $ + tulostekustannus 0,0075 $ = 0,01 $ per pyyntö10 000 pyynnöllä kuukaudessa se on noin 100 $/kk — pienet per-pyyntö-kustannukset kasautuvat nopeasti mittakaavassa, minkä vuoksi laskelman tarkistaminen ennen mallin valintaa on tärkeää.
Syöte- vs. tulostekustannuksen ymmärtäminen
Jokainen tämän listan malli hinnoittelee syöte- ja tulostetokenit erikseen, ja niiden välinen kuilu on suuri ja johdonmukainen toimittajien välillä — tuloste maksaa säännöllisesti 5–6-kertaisesti enemmän per token kuin syöte. Tämä tarkoittaa, että puhelias, monisanainen mallivastaus maksaa suhteettoman paljon enemmän kuin pitkä kehote lyhyellä vastauksella, vaikka kokonaistokenmäärä näyttäisi samankaltaiselta.
Käytännön seuraus: jos optimoit API-kuluja, tulosteen pituuden karsiminen (lyhyemmät järjestelmäkehote-ohjeet kuten "vastaa yhdellä kappaleella") säästää yleensä enemmän kuin syötteen karsiminen, token tokenilta.
Karkea kuukausikustannus käyttötavan mukaan
Nämä ovat havainnollistavia esimerkkejä, ei tarjouksia — käytä yllä olevaa laskuria omilla tokenmäärilläsi ja mallivalinnallasi tarkkaa lukua varten.
| Käyttötapa | Tyypillinen tokenit/pyyntö | Esimerkkimalli | Karkea kuukausikustannus (10k pyyntöä) |
|---|---|---|---|
| Lyhyet chatbot-vastaukset | 300 sisään / 150 ulos | GPT-5.4 Nano | ≈ 2–3 $/kk |
| Datan luokittelu ja merkitseminen | 500 sisään / 50 ulos | DeepSeek V4 Flash | ≈ 1 $/kk |
| Dokumenttien tiivistäminen | 3 000 sisään / 400 ulos | Claude Sonnet 5 | ≈ 100 $/kk |
| Koodinluonnin apuväline | 1 500 sisään / 1 000 ulos | Gemini 3.5 Flash | ≈ 110–115 $/kk |
| Pitkän sisällön luonnostelu | 1 000 sisään / 2 500 ulos | GPT-5.6 Sol | ≈ 800 $/kk |
Usein kysytyt kysymykset
Miksi tuloste hinnoitellaan niin paljon kalliimmaksi kuin syöte jokaisessa mallissa?
Tokenien tuottaminen (tuloste) vaatii täyden eteenpäin-läpiajon mallin läpi jokaista uutta tokenia kohden, ajettuna peräkkäin, kun taas syötetokenien (kehotteen) käsittely voidaan tehdä rinnakkain yhdessä erässä. Tuo epäsymmetrinen laskentakustannus on syy, miksi jokainen suuri toimittaja hinnoittelee tulosteen noin 4–8-kertaisesti syötteen hintaan verrattuna.
Miten tiedän, kuinka monta tokenia kehotteeni käyttää?
Käytä CodeKitHubin Token Counter -työkalua — liitä varsinainen kehotteesi tai järjestelmäviestisi, ja se näyttää tarkan tokenmäärän oikealla tokenisoijalla karkean merkkipohjaisen arvauksen sijaan. Tulostetokenien määrää on vaikeampi ennustaa etukäteen; järkevä lähestymistapa on tarkistaa todellinen käyttö muutamasta oikeasta API-vastauksesta ja käyttää sitä arviona.
Ovatko nämä hinnat taatusti ajan tasalla?
Ei — tekoälytoimittajien API-hinnat muuttuvat melko usein, joskus vähäisellä ennakkovaroituksella. Tämän työkalun hinnat on vahvistettu suoraan kunkin toimittajan virallisesta hintasivusta laskurin lähellä näkyvänä päivämääränä. Ennen budjetti- tai ostopäätöstä tarkista nykyinen sivu itse: OpenAI-hinnasto (developers.openai.com/api/docs/pricing), Anthropic/Claude-hinnasto (platform.claude.com/docs/en/about-claude/pricing) ja Google Gemini -hinnasto (ai.google.dev/gemini-api/docs/pricing).
Miksi [suosikkimallini] ei ole listalla?
Tämä työkalu kattaa edustavan budjetti-/keski-/lippulaivavalikoiman OpenAI:lta, Anthropicilta, Googlelta, DeepSeekiltä, Qwenilta, Moonshotilta, Zhipulta ja xAI:lta (yhteensä 19 mallia) sen sijaan, että kattaisi jokaisen toimittajan tarjoaman mallin, jotta lista pysyy helposti silmäiltävänä ja hintadata helposti ajan tasalla pidettävänä. Jos tarvitset mallia, jota ei ole listattu, tarkista sen hinta miljoonaa tokenia kohden toimittajan sivulta ja tee sama syöte- + tulostekustannuslaskelma käsin.
Huomioiko Gemini 3.1 Pro Preview -hinta pitkät kehotteet?
Ei — näytetty hinta on Googlen ≤200 000-tokenin taso. Geminin hinnoittelu nousee tätä kynnystä pidemmille kehotteille, eikä tämä laskuri mallinna tuota lisämaksuporrasta työkalun yksinkertaisuuden säilyttämiseksi. Jos kehotteesi ylittävät säännöllisesti 200k tokenia, tarkista tarkka pitkän kontekstin hinta Googlen hintasivulta.
Ovatko DeepSeek-, Qwen-, Kimi- ja GLM-hinnat dollareissa?
Kyllä — kaikki tämän työkalun hinnat, kiinalaiset mallit mukaan lukien, ovat viralliset kansainväliset API-hinnat dollareissa, jotta jokaista mallia voi vertailla samalla perusteella. Jotkin näistä toimittajista tarjoavat myös yuaneina (CNY) laskutettavia konsoleita manner-Kiinan tileille eri (usein halvemmilla) hinnoilla; tarkista toimittajan oma konsoli, jos laskutat CNY:nä.
Pitäisikö optimoida syöte- vai tulostekustannusta?
Katso työkuormasi muotoa. Jos se on syötepainotteinen — pitkiä dokumentteja sisään, lyhyitä vastauksia ulos (luokittelu, poiminta, RAG) — syötehinnoittelu ja kehotteiden välimuistitus hallitsevat laskuasi. Jos se on tulostepainotteinen — pitkiä tuotoksia lyhyistä kehotteista — tulostehinnoittelu on tärkeintä, ja tulostetokenit maksavat tyypillisesti moninkertaisesti enemmän per token kuin syöte samassa mallissa.