CodeKitHub
Pigiausias LLM API 2026 m.: išsamus 19 modelių kainų palyginimas

Pigiausias LLM API 2026 m.: išsamus 19 modelių kainų palyginimas

Paskelbta 2026-07-25

Jei LLM API renkatės vien pagal kainą, skirtumai yra didesni, nei dauguma tikisi. Palyginus visus 19 modelių, kuriuos seka šios svetainės LLM API kainų skaičiuoklė — OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot/Kimi, Zhipu/GLM ir xAI — pigiausias ir brangiausias modelis, lyginant vienodomis sąlygomis, skiriasi daugiau nei 60 kartų. Šis skirtumas reiškia gerokai daugiau nei tai, prie kurio tiekėjo logotipo esate pripratę.

Reitingas

Kad palyginimas būtų sąžiningas, kiekvienas žemiau esantis modelis vertinamas pagal mišrų tarifą: 750 000 įvesties tokenų + 250 000 išvesties tokenų kiekvienam 1 mln. tokenų — tai maždaug atitinka tipišką pokalbio tipo užklausą, kai atsakymas trumpesnis už užklausą. Kainos nurodytos už 1 mln. tokenų ir patikrintos pagal kiekvieno tiekėjo oficialų kainų puslapį.

Vieta Modelis Tiekėjas Įvestis Išvestis Mišri (3:1)
1 Gemini 2.5 Flash-Lite Google $0.10 $0.40 $0.175
1 DeepSeek V4 Flash DeepSeek $0.14 $0.28 $0.175
3 Qwen3.6 Flash Qwen $0.19 $1.13 $0.42
4 GPT-5.4 Nano OpenAI $0.20 $1.25 $0.46
5 DeepSeek V4 Pro DeepSeek $0.44 $0.87 $0.54
6 Grok Code Fast 1 xAI $1.00 $2.00 $1.25
7 GPT-5.4 Mini OpenAI $0.75 $4.50 $1.69
8 Claude Haiku 4.5 Anthropic $1.00 $5.00 $2.00
9 GLM-5.2 Zhipu $1.40 $4.40 $2.15
10 GPT-5.6 Luna OpenAI $1.00 $6.00 $2.25
11 Grok 4.5 xAI $2.00 $6.00 $3.00
12 Gemini 3.5 Flash Google $1.50 $9.00 $3.38
13 Qwen3.7 Max Qwen $2.50 $7.50 $3.75
14 Claude Sonnet 5 Anthropic $2.00 $10.00 $4.00
15 Gemini 3.1 Pro Preview Google $2.00 $12.00 $4.50
16 GPT-5.6 Terra OpenAI $2.50 $15.00 $5.63
17 Kimi K3 Moonshot $3.00 $15.00 $6.00
18 Claude Opus 5 Anthropic $5.00 $25.00 $10.00
19 GPT-5.6 Sol OpenAI $5.00 $30.00 $11.25

Į akis krenta keli dalykai. Kiekvienas tiekėjas — ne tik vienas — turi ir biudžetinę, ir flagmanų klasę, besiskiriančias keliais kartais, tad klausimas „kuris tiekėjas pigiausias“ yra klaidingas; teisingas klausimas — „kuris konkretus modelis“. Antra, du pigiausi modeliai (Gemini 2.5 Flash-Lite ir DeepSeek V4 Flash) turi lygiai tą patį mišrų tarifą, nors juos kuria tarpusavyje nesusijusios įmonės — pačiame žemiausiame segmente biudžetinės klasės kainos susivienodino, o ne vienas tiekėjas nurungė visus kitus.

Kodėl pigiausias modelis nebūtinai yra tinkamiausias

Vien kaina nepasako, ar modelis pakankamai geras jūsų užduočiai. Biudžetinės klasės modeliai paprastai puikiai tinka klasifikavimui, duomenų ištraukimui, trumpiems atsakymams ir kitiems siauriems, aiškiai apibrėžtiems darbams — tokiam darbui flagmaninio modelio papildomos samprotavimo galimybės lieka nepanaudotos. Jie prasčiau tinka atviro pobūdžio samprotavimams, ilgiems kelių žingsnių agentų procesams ar užduotims, kuriose klaidingą atsakymą vėliau brangu pastebėti; pigesnis modelis, kuris užduotį atlieka neteisingai ir reikalauja pakartojimo (arba žmogaus pataisymo), galiausiai gali kainuoti daugiau nei brangesnis modelis, kuris viską padaro teisingai iš pirmo karto.

Protingas atspirties taškas: prototipą kurkite su modeliu, kurį geriausiai pažįstate, o kai užduotis bus aiškiai apibrėžta, patikrinkite, ar biudžetinės klasės modelis iš tos pačios lentelės duoda pakankamai panašų rezultatą — jei taip, sutaupymai augant mastui kaupiasi; jei ne, kainų skirtumas ir nebuvo tikroji išlaidų priežastis.

Kaip gauti savo tikrąjį skaičių

Šioje lentelėje naudojamas fiksuotas 3:1 mišinys, kad būtų galima sudaryti reitingą, tačiau jūsų tikrasis įvesties/išvesties tokenų santykis beveik tikrai nėra 3:1 — santraukų užduotis gali siekti 10:1, o kodo generavimo — arčiau 1:2. Aukščiau pateiktas mišrus reitingas yra geras atspirties taškas renkantis kandidatus testavimui, bet ne pakaitalas jūsų konkrečių išlaidų skaičiavimui.

Tam naudokite LLM API kainų skaičiuoklę tiesiogiai: įveskite savo faktinius įvesties ir išvesties tokenų kiekius, ir ji apskaičiuos tikslią kainą bet kuriam iš šių 19 modelių, o jei apytiksliai žinote, kiek užklausų darysite, — ir mėnesio sąmatą. Jei savo tokenų skaičių dar nežinote, Tokenų skaičiuoklė pateiks tikrą skaičių iš realios užklausos, o ne apytikslį spėjimą. Abu įrankiai veikia tik jūsų naršyklėje — jokio API rakto, jokios paskyros, niekas neįkeliama.

← Grįžti į tinklaraštį