
Najjeftiniji LLM API u 2026.: potpuna usporedba cijena, 19 modela
Objavljeno 25. srp 2026.
Ako birate LLM API isključivo prema cijeni, raspon je veći nego što većina ljudi očekuje. Usporedimo li svih 19 modela koje prati LLM API Pricing Calculator na ovoj stranici — OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot/Kimi, Zhipu/GLM i xAI — najjeftiniji i najskuplji model razlikuju se više od 60x pri usporedbi pod jednakim uvjetima. Ta razlika znači puno više od toga na čiji ste logo navikli.
Poredak
Radi poštene usporedbe, svaki model u nastavku ocijenjen je kombiniranom stopom: 750.000 ulaznih tokena + 250.000 izlaznih tokena na 1M ukupnih tokena, što otprilike odgovara tipičnom chat zahtjevu u kojem je odgovor kraći od upita. Cijene su izražene po 1M tokena i provjerene prema službenoj stranici s cijenama svakog pružatelja.
| Rang | Model | Pružatelj | Ulaz | Izlaz | Kombinirano (3:1) |
|---|---|---|---|---|---|
| 1 | Gemini 2.5 Flash-Lite | $0.10 | $0.40 | $0.175 | |
| 1 | DeepSeek V4 Flash | DeepSeek | $0.14 | $0.28 | $0.175 |
| 3 | Qwen3.6 Flash | Qwen | $0.19 | $1.13 | $0.42 |
| 4 | GPT-5.4 Nano | OpenAI | $0.20 | $1.25 | $0.46 |
| 5 | DeepSeek V4 Pro | DeepSeek | $0.44 | $0.87 | $0.54 |
| 6 | Grok Code Fast 1 | xAI | $1.00 | $2.00 | $1.25 |
| 7 | GPT-5.4 Mini | OpenAI | $0.75 | $4.50 | $1.69 |
| 8 | Claude Haiku 4.5 | Anthropic | $1.00 | $5.00 | $2.00 |
| 9 | GLM-5.2 | Zhipu | $1.40 | $4.40 | $2.15 |
| 10 | GPT-5.6 Luna | OpenAI | $1.00 | $6.00 | $2.25 |
| 11 | Grok 4.5 | xAI | $2.00 | $6.00 | $3.00 |
| 12 | Gemini 3.5 Flash | $1.50 | $9.00 | $3.38 | |
| 13 | Qwen3.7 Max | Qwen | $2.50 | $7.50 | $3.75 |
| 14 | Claude Sonnet 5 | Anthropic | $2.00 | $10.00 | $4.00 |
| 15 | Gemini 3.1 Pro Preview | $2.00 | $12.00 | $4.50 | |
| 16 | GPT-5.6 Terra | OpenAI | $2.50 | $15.00 | $5.63 |
| 17 | Kimi K3 | Moonshot | $3.00 | $15.00 | $6.00 |
| 18 | Claude Opus 5 | Anthropic | $5.00 | $25.00 | $10.00 |
| 19 | GPT-5.6 Sol | OpenAI | $5.00 | $30.00 | $11.25 |
Nekoliko stvari upada u oči. Svaki pružatelj — ne samo jedan — ima i budžetni i vrhunski razred s višestrukom razlikom u cijeni, pa je “koji je pružatelj najjeftiniji” pogrešno pitanje; “koji konkretan model” pravo je pitanje. Drugo, dva najjeftinija modela (Gemini 2.5 Flash-Lite i DeepSeek V4 Flash) završavaju na točno istoj kombiniranoj stopi iako dolaze od nepovezanih tvrtki — na samom donjem kraju, cijene budžetnog razreda su se izjednačile umjesto da jedan pružatelj podcjenjuje ostale.
Zašto najjeftiniji model nije automatski pravi izbor
Sama cijena ne govori vam je li model dovoljno dobar za vaš zadatak. Budžetni modeli obično su sasvim u redu za klasifikaciju, ekstrakciju, kratke odgovore i druge uske, dobro definirane poslove — vrstu posla u kojoj dodatna sposobnost zaključivanja vrhunskog modela ostaje neiskorištena. Lošiji su izbor za otvoreno zaključivanje, duge višekoračne agentske tijekove rada ili zadatke kod kojih je pogrešan odgovor skupo otkriti kasnije; jeftiniji model koji pogriješi i zahtijeva ponovni pokušaj (ili ljudsku intervenciju) na kraju može koštati više od skupljeg modela koji zadatak riješi iz prve.
Razuman zadani pristup: prototipirajte s modelom koji najbolje poznajete, a zatim, kad je zadatak dobro definiran, testirajte proizvodi li budžetni model iz iste tablice prihvatljivo sličan rezultat — ako da, ušteda se množi s razmjerom; ako ne, razlika u cijeni ionako nije bila stvarni pokretač troška.
Kako doći do svoje stvarne brojke
Ova tablica koristi fiksni omjer 3:1 kako bi rangiranje uopće bilo moguće, ali vaš stvarni omjer ulaznih i izlaznih tokena gotovo sigurno nije 3:1 — zadatak sažimanja može biti 10:1, generiranje koda bliže 1:2. Gornji kombinirani poredak razumna je polazna točka za odabir kandidata za testiranje, a ne zamjena za izračun vašeg konkretnog troška.
Za to upotrijebite izravno LLM API Pricing Calculator: unesite stvarne brojeve ulaznih i izlaznih tokena i on izračunava točan trošak za bilo koji od ovih 19 modela, plus mjesečnu procjenu ako otprilike znate koliko ćete zahtjeva slati. Ako još ne znate svoje brojeve tokena, alat Token Counter daje vam stvarnu brojku iz pravog upita, umjesto grube procjene. Oba rade u potpunosti u vašem pregledniku — bez API ključa, bez računa, ništa se ne prenosi.