CodeKitHub
Halvin LLM API vuonna 2026: täysi hintavertailu, 19 mallia

Halvin LLM API vuonna 2026: täysi hintavertailu, 19 mallia

Julkaistu 25.7.2026

Jos valitset LLM API:n pelkän hinnan perusteella, hajonta on suurempi kuin useimmat odottavat. Kun vertaillaan kaikkia 19 mallia, joita tämän sivuston LLM API Pricing Calculator seuraa — OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot/Kimi, Zhipu/GLM ja xAI — halvimman ja kalleimman mallin ero on yli 60-kertainen samoilla ehdoilla mitattuna. Tuo ero merkitsee paljon enemmän kuin se, minkä toimittajan logoon olet tottunut.

Järjestys

Reilun vertailun vuoksi jokainen alla oleva malli on pisteytetty yhdistetyllä hinnalla: 750 000 syötetokenia + 250 000 tulostetokenia miljoonaa tokenia kohden, mikä vastaa suunnilleen tyypillistä chat-tyyppistä pyyntöä, jossa vastaus on kehotetta lyhyempi. Hinnat ovat per 1M tokenia, ja ne on tarkistettu kunkin toimittajan virallisilta hintasivuilta.

Sija Malli Toimittaja Syöte Tuloste Yhdistetty (3:1)
1 Gemini 2.5 Flash-Lite Google $0.10 $0.40 $0.175
1 DeepSeek V4 Flash DeepSeek $0.14 $0.28 $0.175
3 Qwen3.6 Flash Qwen $0.19 $1.13 $0.42
4 GPT-5.4 Nano OpenAI $0.20 $1.25 $0.46
5 DeepSeek V4 Pro DeepSeek $0.44 $0.87 $0.54
6 Grok Code Fast 1 xAI $1.00 $2.00 $1.25
7 GPT-5.4 Mini OpenAI $0.75 $4.50 $1.69
8 Claude Haiku 4.5 Anthropic $1.00 $5.00 $2.00
9 GLM-5.2 Zhipu $1.40 $4.40 $2.15
10 GPT-5.6 Luna OpenAI $1.00 $6.00 $2.25
11 Grok 4.5 xAI $2.00 $6.00 $3.00
12 Gemini 3.5 Flash Google $1.50 $9.00 $3.38
13 Qwen3.7 Max Qwen $2.50 $7.50 $3.75
14 Claude Sonnet 5 Anthropic $2.00 $10.00 $4.00
15 Gemini 3.1 Pro Preview Google $2.00 $12.00 $4.50
16 GPT-5.6 Terra OpenAI $2.50 $15.00 $5.63
17 Kimi K3 Moonshot $3.00 $15.00 $6.00
18 Claude Opus 5 Anthropic $5.00 $25.00 $10.00
19 GPT-5.6 Sol OpenAI $5.00 $30.00 $11.25

Muutama asia pistää silmään. Jokaisella toimittajalla — ei vain yhdellä — on sekä budjettitason että lippulaivatason malli, joiden välillä on moninkertainen hintaero, joten “mikä toimittaja on halvin” on väärä kysymys; “mikä tietty malli” on oikea. Toiseksi kaksi halvinta mallia (Gemini 2.5 Flash-Lite ja DeepSeek V4 Flash) osuvat täsmälleen samaan yhdistettyyn hintaan, vaikka ne tulevat toisistaan riippumattomilta yhtiöiltä — aivan halvimmassa päässä budjettitason hinnoittelu on lähentynyt sen sijaan, että yksi toimittaja alittaisi muut.

Miksi halvin malli ei ole automaattisesti oikea valinta

Hinta yksin ei kerro, onko malli riittävän hyvä tehtävääsi. Budjettitason mallit riittävät yleensä luokitteluun, tiedon poimintaan, lyhyisiin vastauksiin ja muihin kapeisiin, tarkasti määriteltyihin töihin — sellaisiin, joissa lippulaivamallin ylimääräinen päättelykyky jää käyttämättä. Ne sopivat huonommin avoimeen päättelyyn, pitkiin monivaiheisiin agenttityönkulkuihin tai tehtäviin, joissa väärän vastauksen huomaaminen jälkikäteen tulee kalliiksi; halvempi malli, joka tekee tehtävän väärin ja vaatii uuden yrityksen (tai ihmisen korjauksen), voi lopulta maksaa enemmän kuin kalliimpi malli, joka onnistuu ensimmäisellä kerralla.

Järkevä oletusstrategia: prototypoi sillä mallilla, jonka tunnet parhaiten, ja kun tehtävä on hyvin määritelty, testaa tuottaako saman taulukon budjettitason malli riittävän samankaltaista tulosta — jos tuottaa, säästöt kertautuvat skaalassa; jos ei, hintaero ei ollutkaan todellinen kustannusajuri.

Oman lukusi laskeminen

Tämä taulukko käyttää kiinteää 3:1-suhdetta, jotta järjestäminen olisi mahdollista, mutta sinun todellinen syöte/tuloste-tokenjakosi ei lähes varmasti ole 3:1 — tiivistystehtävä voi olla 10:1 ja koodigenerointi lähempänä suhdetta 1:2. Yllä oleva yhdistetty järjestys on järkevä lähtökohta ehdokkaiden valintaan testattavaksi, ei korvike oman tarkan kustannuksesi laskemiselle.

Sitä varten käytä suoraan LLM API Pricing Calculator -työkalua: syötä todelliset syöte- ja tulostetokenmääräsi, ja se laskee tarkan kustannuksen mille tahansa näistä 19 mallista sekä kuukausiarvion, jos tiedät suunnilleen pyyntöjesi määrän. Jos et vielä tiedä tokenmääriäsi, Token Counter -työkalu antaa todellisen luvun oikeasta kehotteesta karkean arvauksen sijaan. Molemmat toimivat kokonaan selaimessasi — ei API-avainta, ei tiliä, mitään ei ladata palvelimelle.

← Takaisin blogiin