CodeKitHub
Tekoälytyökalut

LLM API -hintalaskuri

Viimeksi päivitetty:

Valitse malli, syötä syöte- ja tulostetokenien määrä, ja näe tarkka hinta per pyyntö — sekä arvioitu kuukausihinta, jos tiedät suunnilleen kuinka monta pyyntöä teet. Alla oleva vertailutaulukko järjestää kaikki 19 mallia hinnan mukaan samoilla tokenmäärillä, joten näet heti, onko GPT, Claude, Gemini, DeepSeek, Qwen, Kimi, GLM vai Grok halvin työkuormaasi. Kattaa nykyiset mallit OpenAI:lta, Anthropicilta, Googlelta, DeepSeekiltä, Qwenilta (Alibaba), Moonshotilta (Kimi), Zhipulta (GLM) ja xAI:lta (Grok), hinnat vahvistettu suoraan kunkin toimittajan virallisilta hintasivuilta. Kaikki toimii paikallisesti selaimessasi.

Prices last verified: August 17, 2026

AI vendor API pricing changes frequently — these figures are for reference only. Check the vendor's official pricing page before making budget or purchasing decisions.

Mikä tämä työkalu on?

LLM-API:t laskutetaan tokeneittain, ei pyynnöittäin — ja syötetokenit (kehotteesi, järjestelmäviesti, keskusteluhistoria) hinnoitellaan eri tavalla kuin tulostetokenit (mallin tuottama sisältö), yleensä 4–8-kertaisella hinnankorotuksella tulosteelle. Tuo jako tekee "paljonko tämä maksaa" vaikeasti arvioitavaksi, varsinkin kun vertailet malleja eri toimittajien välillä erilaisin hintakortein.

Tämä laskuri ottaa syöte- ja tulostetokeniesi määrän, kertoo kummankin valitun mallin miljoonaa tokenia kohden lasketulla hinnalla ja laskee ne yhteen — samaa matematiikkaa, jota toimittajan laskutusjärjestelmä käyttää. Lisää kuukausittainen pyyntömäärä, ja se ennustaa kuukausikokonaissumman, hyödyllistä budjetointiin ennen kuin sitoudut malliin tuotannossa.

Miksi käyttää sitä?

  • 19 mallia OpenAI:lta, Anthropicilta, Googlelta, DeepSeekiltä, Qwenilta, Moonshotilta, Zhipulta ja xAI:lta — budjetti-, keski- ja lippulaivavaihtoehtoja, mukaan lukien merkittävät kiinalaiset malli-API:t ja Grok.
  • Rinnakkainen vertailutaulukko järjestää jokaisen mallin hinnan mukaan tarkoilla tokenmäärilläsi, joten sinun ei tarvitse laskea jokaista käsin.
  • Erillinen syöte-/tulostekustannuserittely, koska tulostetokenit hinnoitellaan moninkertaisesti kalliimmiksi kuin syötetokenit jokaisella toimittajalla.
  • Valinnainen kuukausittainen pyyntömäärä nopeaan budjettiennusteeseen, ei vain yhden pyynnön arvioon.
  • Hinnat vahvistettu suoraan toimittajien dokumentaatiosta, vahvistuspäivämäärä näkyvissä — ei kaavittu tai arvioitu.
  • 100 % paikallinen — ei API-avainta, ei tiliä, mitään dataa ei poistu selaimestasi.

Käyttöohje

  1. Valitse malli pudotusvalikosta, ryhmiteltynä toimittajan mukaan (OpenAI / Anthropic / Google / DeepSeek / Qwen / Moonshot / Zhipu / xAI).
  2. Syötä syötetokenien määrä (kehote + järjestelmäviesti + mahdollinen konteksti) ja odotettu tulostetokenien määrä.
  3. Lue hinta per pyyntö, eriteltynä syöte- ja tulostekustannukseen.
  4. Syötä valinnaisesti pyynnöt kuukaudessa nähdäksesi arvioidun kuukausihinnan.
  5. Vieritä alas vertailutaulukkoon nähdäksesi jokaisen mallin järjestettynä hinnan mukaan samoilla tokenmäärillä.

Esimerkki

Syöte

GPT-5.6 Terra, 1 000 syötetokenia, 500 tulostetokenia

Tuloste

Syötekustannus 0,0025 $ + tulostekustannus 0,0075 $ = 0,01 $ per pyyntö

10 000 pyynnöllä kuukaudessa se on noin 100 $/kk — pienet per-pyyntö-kustannukset kasautuvat nopeasti mittakaavassa, minkä vuoksi laskelman tarkistaminen ennen mallin valintaa on tärkeää.

Syöte- vs. tulostekustannuksen ymmärtäminen

Jokainen tämän listan malli hinnoittelee syöte- ja tulostetokenit erikseen, ja niiden välinen kuilu on suuri ja johdonmukainen toimittajien välillä — tuloste maksaa säännöllisesti 5–6-kertaisesti enemmän per token kuin syöte. Tämä tarkoittaa, että puhelias, monisanainen mallivastaus maksaa suhteettoman paljon enemmän kuin pitkä kehote lyhyellä vastauksella, vaikka kokonaistokenmäärä näyttäisi samankaltaiselta.

Käytännön seuraus: jos optimoit API-kuluja, tulosteen pituuden karsiminen (lyhyemmät järjestelmäkehote-ohjeet kuten "vastaa yhdellä kappaleella") säästää yleensä enemmän kuin syötteen karsiminen, token tokenilta.

Karkea kuukausikustannus käyttötavan mukaan

Nämä ovat havainnollistavia esimerkkejä, ei tarjouksia — käytä yllä olevaa laskuria omilla tokenmäärilläsi ja mallivalinnallasi tarkkaa lukua varten.

KäyttötapaTyypillinen tokenit/pyyntöEsimerkkimalliKarkea kuukausikustannus (10k pyyntöä)
Lyhyet chatbot-vastaukset300 sisään / 150 ulosGPT-5.4 Nano≈ 2–3 $/kk
Datan luokittelu ja merkitseminen500 sisään / 50 ulosDeepSeek V4 Flash≈ 1 $/kk
Dokumenttien tiivistäminen3 000 sisään / 400 ulosClaude Sonnet 5≈ 100 $/kk
Koodinluonnin apuväline1 500 sisään / 1 000 ulosGemini 3.5 Flash≈ 110–115 $/kk
Pitkän sisällön luonnostelu1 000 sisään / 2 500 ulosGPT-5.6 Sol≈ 800 $/kk

Usein kysytyt kysymykset

Miksi tuloste hinnoitellaan niin paljon kalliimmaksi kuin syöte jokaisessa mallissa?

Tokenien tuottaminen (tuloste) vaatii täyden eteenpäin-läpiajon mallin läpi jokaista uutta tokenia kohden, ajettuna peräkkäin, kun taas syötetokenien (kehotteen) käsittely voidaan tehdä rinnakkain yhdessä erässä. Tuo epäsymmetrinen laskentakustannus on syy, miksi jokainen suuri toimittaja hinnoittelee tulosteen noin 4–8-kertaisesti syötteen hintaan verrattuna.

Miten tiedän, kuinka monta tokenia kehotteeni käyttää?

Käytä CodeKitHubin Token Counter -työkalua — liitä varsinainen kehotteesi tai järjestelmäviestisi, ja se näyttää tarkan tokenmäärän oikealla tokenisoijalla karkean merkkipohjaisen arvauksen sijaan. Tulostetokenien määrää on vaikeampi ennustaa etukäteen; järkevä lähestymistapa on tarkistaa todellinen käyttö muutamasta oikeasta API-vastauksesta ja käyttää sitä arviona.

Ovatko nämä hinnat taatusti ajan tasalla?

Ei — tekoälytoimittajien API-hinnat muuttuvat melko usein, joskus vähäisellä ennakkovaroituksella. Tämän työkalun hinnat on vahvistettu suoraan kunkin toimittajan virallisesta hintasivusta laskurin lähellä näkyvänä päivämääränä. Ennen budjetti- tai ostopäätöstä tarkista nykyinen sivu itse: OpenAI-hinnasto (developers.openai.com/api/docs/pricing), Anthropic/Claude-hinnasto (platform.claude.com/docs/en/about-claude/pricing) ja Google Gemini -hinnasto (ai.google.dev/gemini-api/docs/pricing).

Miksi [suosikkimallini] ei ole listalla?

Tämä työkalu kattaa edustavan budjetti-/keski-/lippulaivavalikoiman OpenAI:lta, Anthropicilta, Googlelta, DeepSeekiltä, Qwenilta, Moonshotilta, Zhipulta ja xAI:lta (yhteensä 19 mallia) sen sijaan, että kattaisi jokaisen toimittajan tarjoaman mallin, jotta lista pysyy helposti silmäiltävänä ja hintadata helposti ajan tasalla pidettävänä. Jos tarvitset mallia, jota ei ole listattu, tarkista sen hinta miljoonaa tokenia kohden toimittajan sivulta ja tee sama syöte- + tulostekustannuslaskelma käsin.

Huomioiko Gemini 3.1 Pro Preview -hinta pitkät kehotteet?

Ei — näytetty hinta on Googlen ≤200 000-tokenin taso. Geminin hinnoittelu nousee tätä kynnystä pidemmille kehotteille, eikä tämä laskuri mallinna tuota lisämaksuporrasta työkalun yksinkertaisuuden säilyttämiseksi. Jos kehotteesi ylittävät säännöllisesti 200k tokenia, tarkista tarkka pitkän kontekstin hinta Googlen hintasivulta.

Ovatko DeepSeek-, Qwen-, Kimi- ja GLM-hinnat dollareissa?

Kyllä — kaikki tämän työkalun hinnat, kiinalaiset mallit mukaan lukien, ovat viralliset kansainväliset API-hinnat dollareissa, jotta jokaista mallia voi vertailla samalla perusteella. Jotkin näistä toimittajista tarjoavat myös yuaneina (CNY) laskutettavia konsoleita manner-Kiinan tileille eri (usein halvemmilla) hinnoilla; tarkista toimittajan oma konsoli, jos laskutat CNY:nä.

Pitäisikö optimoida syöte- vai tulostekustannusta?

Katso työkuormasi muotoa. Jos se on syötepainotteinen — pitkiä dokumentteja sisään, lyhyitä vastauksia ulos (luokittelu, poiminta, RAG) — syötehinnoittelu ja kehotteiden välimuistitus hallitsevat laskuasi. Jos se on tulostepainotteinen — pitkiä tuotoksia lyhyistä kehotteista — tulostehinnoittelu on tärkeintä, ja tulostetokenit maksavat tyypillisesti moninkertaisesti enemmän per token kuin syöte samassa mallissa.

Liittyvät työkalut