
Pigiausias LLM API 2026 m.: išsamus 19 modelių kainų palyginimas
Paskelbta 2026-07-25
Jei LLM API renkatės vien pagal kainą, skirtumai yra didesni, nei dauguma tikisi. Palyginus visus 19 modelių, kuriuos seka šios svetainės LLM API kainų skaičiuoklė — OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot/Kimi, Zhipu/GLM ir xAI — pigiausias ir brangiausias modelis, lyginant vienodomis sąlygomis, skiriasi daugiau nei 60 kartų. Šis skirtumas reiškia gerokai daugiau nei tai, prie kurio tiekėjo logotipo esate pripratę.
Reitingas
Kad palyginimas būtų sąžiningas, kiekvienas žemiau esantis modelis vertinamas pagal mišrų tarifą: 750 000 įvesties tokenų + 250 000 išvesties tokenų kiekvienam 1 mln. tokenų — tai maždaug atitinka tipišką pokalbio tipo užklausą, kai atsakymas trumpesnis už užklausą. Kainos nurodytos už 1 mln. tokenų ir patikrintos pagal kiekvieno tiekėjo oficialų kainų puslapį.
| Vieta | Modelis | Tiekėjas | Įvestis | Išvestis | Mišri (3:1) |
|---|---|---|---|---|---|
| 1 | Gemini 2.5 Flash-Lite | $0.10 | $0.40 | $0.175 | |
| 1 | DeepSeek V4 Flash | DeepSeek | $0.14 | $0.28 | $0.175 |
| 3 | Qwen3.6 Flash | Qwen | $0.19 | $1.13 | $0.42 |
| 4 | GPT-5.4 Nano | OpenAI | $0.20 | $1.25 | $0.46 |
| 5 | DeepSeek V4 Pro | DeepSeek | $0.44 | $0.87 | $0.54 |
| 6 | Grok Code Fast 1 | xAI | $1.00 | $2.00 | $1.25 |
| 7 | GPT-5.4 Mini | OpenAI | $0.75 | $4.50 | $1.69 |
| 8 | Claude Haiku 4.5 | Anthropic | $1.00 | $5.00 | $2.00 |
| 9 | GLM-5.2 | Zhipu | $1.40 | $4.40 | $2.15 |
| 10 | GPT-5.6 Luna | OpenAI | $1.00 | $6.00 | $2.25 |
| 11 | Grok 4.5 | xAI | $2.00 | $6.00 | $3.00 |
| 12 | Gemini 3.5 Flash | $1.50 | $9.00 | $3.38 | |
| 13 | Qwen3.7 Max | Qwen | $2.50 | $7.50 | $3.75 |
| 14 | Claude Sonnet 5 | Anthropic | $2.00 | $10.00 | $4.00 |
| 15 | Gemini 3.1 Pro Preview | $2.00 | $12.00 | $4.50 | |
| 16 | GPT-5.6 Terra | OpenAI | $2.50 | $15.00 | $5.63 |
| 17 | Kimi K3 | Moonshot | $3.00 | $15.00 | $6.00 |
| 18 | Claude Opus 5 | Anthropic | $5.00 | $25.00 | $10.00 |
| 19 | GPT-5.6 Sol | OpenAI | $5.00 | $30.00 | $11.25 |
Į akis krenta keli dalykai. Kiekvienas tiekėjas — ne tik vienas — turi ir biudžetinę, ir flagmanų klasę, besiskiriančias keliais kartais, tad klausimas „kuris tiekėjas pigiausias“ yra klaidingas; teisingas klausimas — „kuris konkretus modelis“. Antra, du pigiausi modeliai (Gemini 2.5 Flash-Lite ir DeepSeek V4 Flash) turi lygiai tą patį mišrų tarifą, nors juos kuria tarpusavyje nesusijusios įmonės — pačiame žemiausiame segmente biudžetinės klasės kainos susivienodino, o ne vienas tiekėjas nurungė visus kitus.
Kodėl pigiausias modelis nebūtinai yra tinkamiausias
Vien kaina nepasako, ar modelis pakankamai geras jūsų užduočiai. Biudžetinės klasės modeliai paprastai puikiai tinka klasifikavimui, duomenų ištraukimui, trumpiems atsakymams ir kitiems siauriems, aiškiai apibrėžtiems darbams — tokiam darbui flagmaninio modelio papildomos samprotavimo galimybės lieka nepanaudotos. Jie prasčiau tinka atviro pobūdžio samprotavimams, ilgiems kelių žingsnių agentų procesams ar užduotims, kuriose klaidingą atsakymą vėliau brangu pastebėti; pigesnis modelis, kuris užduotį atlieka neteisingai ir reikalauja pakartojimo (arba žmogaus pataisymo), galiausiai gali kainuoti daugiau nei brangesnis modelis, kuris viską padaro teisingai iš pirmo karto.
Protingas atspirties taškas: prototipą kurkite su modeliu, kurį geriausiai pažįstate, o kai užduotis bus aiškiai apibrėžta, patikrinkite, ar biudžetinės klasės modelis iš tos pačios lentelės duoda pakankamai panašų rezultatą — jei taip, sutaupymai augant mastui kaupiasi; jei ne, kainų skirtumas ir nebuvo tikroji išlaidų priežastis.
Kaip gauti savo tikrąjį skaičių
Šioje lentelėje naudojamas fiksuotas 3:1 mišinys, kad būtų galima sudaryti reitingą, tačiau jūsų tikrasis įvesties/išvesties tokenų santykis beveik tikrai nėra 3:1 — santraukų užduotis gali siekti 10:1, o kodo generavimo — arčiau 1:2. Aukščiau pateiktas mišrus reitingas yra geras atspirties taškas renkantis kandidatus testavimui, bet ne pakaitalas jūsų konkrečių išlaidų skaičiavimui.
Tam naudokite LLM API kainų skaičiuoklę tiesiogiai: įveskite savo faktinius įvesties ir išvesties tokenų kiekius, ir ji apskaičiuos tikslią kainą bet kuriam iš šių 19 modelių, o jei apytiksliai žinote, kiek užklausų darysite, — ir mėnesio sąmatą. Jei savo tokenų skaičių dar nežinote, Tokenų skaičiuoklė pateiks tikrą skaičių iš realios užklausos, o ne apytikslį spėjimą. Abu įrankiai veikia tik jūsų naršyklėje — jokio API rakto, jokios paskyros, niekas neįkeliama.