
Goedkoopste LLM API in 2026: volledige prijsvergelijking, 19 modellen
Gepubliceerd op 25 jul 2026
Als je een LLM API puur op kosten kiest, is de spreiding groter dan de meeste mensen verwachten. Wanneer je alle 19 modellen vergelijkt die de LLM API Pricing Calculator van deze site bijhoudt — OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot/Kimi, Zhipu/GLM en xAI — verschillen het goedkoopste en duurste model meer dan 60x op een gelijkwaardige basis. Dat verschil is veel belangrijker dan welk vendorlogo je gewend bent.
De ranglijst
Om eerlijk te vergelijken krijgt elk model hieronder een score op basis van een gemengd tarief: 750.000 input-tokens + 250.000 output-tokens per 1M tokens in totaal, wat ruwweg overeenkomt met een typisch chatverzoek waarbij het antwoord korter is dan de prompt. Prijzen zijn per 1M tokens, geverifieerd aan de hand van de officiële prijspagina van elke aanbieder.
| Rang | Model | Aanbieder | Input | Output | Gemengd (3:1) |
|---|---|---|---|---|---|
| 1 | Gemini 2.5 Flash-Lite | $0.10 | $0.40 | $0.175 | |
| 1 | DeepSeek V4 Flash | DeepSeek | $0.14 | $0.28 | $0.175 |
| 3 | Qwen3.6 Flash | Qwen | $0.19 | $1.13 | $0.42 |
| 4 | GPT-5.4 Nano | OpenAI | $0.20 | $1.25 | $0.46 |
| 5 | DeepSeek V4 Pro | DeepSeek | $0.44 | $0.87 | $0.54 |
| 6 | Grok Code Fast 1 | xAI | $1.00 | $2.00 | $1.25 |
| 7 | GPT-5.4 Mini | OpenAI | $0.75 | $4.50 | $1.69 |
| 8 | Claude Haiku 4.5 | Anthropic | $1.00 | $5.00 | $2.00 |
| 9 | GLM-5.2 | Zhipu | $1.40 | $4.40 | $2.15 |
| 10 | GPT-5.6 Luna | OpenAI | $1.00 | $6.00 | $2.25 |
| 11 | Grok 4.5 | xAI | $2.00 | $6.00 | $3.00 |
| 12 | Gemini 3.5 Flash | $1.50 | $9.00 | $3.38 | |
| 13 | Qwen3.7 Max | Qwen | $2.50 | $7.50 | $3.75 |
| 14 | Claude Sonnet 5 | Anthropic | $2.00 | $10.00 | $4.00 |
| 15 | Gemini 3.1 Pro Preview | $2.00 | $12.00 | $4.50 | |
| 16 | GPT-5.6 Terra | OpenAI | $2.50 | $15.00 | $5.63 |
| 17 | Kimi K3 | Moonshot | $3.00 | $15.00 | $6.00 |
| 18 | Claude Opus 5 | Anthropic | $5.00 | $25.00 | $10.00 |
| 19 | GPT-5.6 Sol | OpenAI | $5.00 | $30.00 | $11.25 |
Een paar dingen vallen op. Elke aanbieder — niet slechts één — heeft zowel een budgetklasse als een vlaggenschipklasse die meerdere keren zo duur is. “Welke aanbieder is het goedkoopst” is dus de verkeerde vraag; “welk specifiek model” is de juiste. Ten tweede komen de twee goedkoopste modellen (Gemini 2.5 Flash-Lite en DeepSeek V4 Flash) uit op precies hetzelfde gemengde tarief, terwijl ze van totaal verschillende bedrijven komen — aan de onderkant van de markt is de budgetprijsstelling geconvergeerd in plaats van dat één aanbieder de rest onderbiedt.
Waarom het goedkoopste model niet automatisch de juiste keuze is
Prijs alleen zegt niets over of een model goed genoeg is voor jouw taak. Budgetmodellen zijn meestal prima voor classificatie, extractie, korte antwoorden en ander smal, goed afgebakend werk — het soort taken waarbij de extra redeneerkracht van een vlaggenschipmodel ongebruikt blijft. Ze passen minder goed bij open redeneertaken, lange agent-workflows met meerdere stappen, of taken waarbij een fout antwoord later duur is om te ontdekken; een goedkoper model dat de taak verkeerd doet en een retry (of een menselijke correctie) nodig heeft, kan uiteindelijk duurder uitpakken dan een prijziger model dat het in één keer goed doet.
Een redelijke standaardaanpak: prototype met het model dat je het beste kent, en test daarna — zodra de taak goed gedefinieerd is — of een budgetmodel uit dezelfde tabel acceptabel vergelijkbare output oplevert. Is dat zo, dan tellen de besparingen op schaal flink op; is dat niet zo, dan was het prijsverschil sowieso niet de echte kostenpost.
Je eigen getal berekenen
Deze tabel gebruikt een vaste 3:1-verhouding om een ranglijst mogelijk te maken, maar jouw echte verhouding tussen input- en output-tokens is vrijwel zeker geen 3:1 — een samenvattingstaak kan 10:1 zijn, een codegeneratietaak eerder 1:2. De gemengde ranglijst hierboven is een redelijk startpunt om kandidaten te kiezen om te testen, geen vervanging voor het berekenen van jouw specifieke kosten.
Gebruik daarvoor direct de LLM API Pricing Calculator: voer je werkelijke aantallen input- en output-tokens in en de tool berekent de exacte kosten voor elk van deze 19 modellen, plus een maandschatting als je ongeveer weet hoeveel verzoeken je gaat doen. Ken je je tokenaantallen nog niet, dan geeft de Token Counter je het echte getal op basis van een echte prompt, in plaats van een ruwe gok. Beide draaien volledig in je browser — geen API-sleutel, geen account, niets wordt geüpload.