Wat is deze tool?
LLM-API's worden per token gefactureerd, niet per aanvraag — en inputtokens (je prompt, systeembericht, chatgeschiedenis) worden anders geprijsd dan outputtokens (wat het model genereert), meestal met een opslag van 4-8x voor output. Die splitsing maakt "hoeveel gaat dit kosten" lastig in te schatten, zeker als je modellen van verschillende aanbieders met verschillende tariefkaarten vergelijkt.
Deze calculator neemt je aantal input- en outputtokens, vermenigvuldigt elk met het per-miljoen-tokentarief van het gekozen model, en telt ze op — dezelfde rekensom die het factureringssysteem van de aanbieder gebruikt. Voeg een maandelijks aanvraagvolume toe en hij projecteert een maandtotaal, handig voor budgettering voordat je in productie voor een model kiest.
Waarom gebruiken?
- 19 modellen van OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu en xAI — budget-, mid-tier- en topopties, inclusief de belangrijkste Chinese model-API's en Grok.
- Een vergelijkingstabel naast elkaar rangschikt elk model op kosten voor jouw exacte tokenaantallen, zodat je niet elk model met de hand hoeft te berekenen.
- Aparte input-/outputkostenopsplitsing, aangezien outputtokens bij elke aanbieder meerdere keren duurder zijn geprijsd dan inputtokens.
- Optioneel maandelijks aanvraagvolume voor een snelle budgetprojectie, niet alleen een schatting per aanvraag.
- Prijzen rechtstreeks geverifieerd aan de hand van documentatie van de aanbieder, met de verificatiedatum getoond — niet gescraped of geschat.
- 100% lokaal — geen API-sleutel, geen account, geen data verlaat je browser.
Hoe te gebruiken
- Selecteer een model uit de dropdown, gegroepeerd per aanbieder (OpenAI / Anthropic / Google / DeepSeek / Qwen / Moonshot / Zhipu / xAI).
- Voer je aantal inputtokens in (prompt + systeembericht + eventuele context) en het verwachte aantal outputtokens.
- Lees de kosten per aanvraag, opgesplitst in inputkosten en outputkosten.
- Voer optioneel het aantal aanvragen per maand in voor een geschatte maandelijkse kost.
- Scroll naar beneden naar de vergelijkingstabel om elk model gerangschikt te zien op kosten voor dezelfde tokenaantallen.
Voorbeeld
Invoer
GPT-5.6 Terra, 1.000 inputtokens, 500 outputtokensUitvoer
Inputkosten $0,0025 + outputkosten $0,0075 = $0,01 per aanvraagBij 10.000 aanvragen/maand is dat ruwweg $100/maand — kleine kosten per aanvraag lopen snel op bij schaal, precies daarom is het controleren van de rekensom voordat je een model kiest zo belangrijk.
Input- versus outputkosten begrijpen
Elk model in deze lijst prijst input- en outputtokens apart, en het verschil daartussen is groot en consistent over aanbieders heen — output kost per token routinematig 5-6x meer dan input. Dat betekent dat een breedsprakige, uitgebreide modelrespons onevenredig meer kost dan een lange prompt met een kort antwoord, zelfs als het totale aantal tokens er vergelijkbaar uitziet.
Praktische implicatie: als je API-uitgaven wilt optimaliseren, bespaart het inkorten van de outputlengte (kortere systeeminstructies zoals "antwoord in één alinea") doorgaans meer, token voor token, dan het inkorten van input.
Ruwe maandelijkse kosten per gebruikspatroon
Dit zijn illustratieve voorbeelden, geen offertes — gebruik de calculator hierboven met je eigen tokenaantallen en modelkeuze voor een exact getal.
| Gebruikspatroon | Typische tokens/aanvraag | Voorbeeldmodel | Ruwe maandkosten (10k aanvragen) |
|---|---|---|---|
| Korte chatbotantwoorden | 300 in / 150 out | GPT-5.4 Nano | ≈ $2-3/maand |
| Datalabeling & classificatie | 500 in / 50 out | DeepSeek V4 Flash | ≈ $1/maand |
| Documentsamenvatting | 3.000 in / 400 out | Claude Sonnet 5 | ≈ $100/maand |
| Codegeneratie-assistent | 1.500 in / 1.000 out | Gemini 3.5 Flash | ≈ $110-115/maand |
| Long-form content schrijven | 1.000 in / 2.500 out | GPT-5.6 Sol | ≈ $800/maand |
Veelgestelde vragen
Waarom is output bij elk model zoveel duurder geprijsd dan input?
Het genereren van tokens (output) vereist voor elk nieuw token een volledige forward pass door het model, sequentieel uitgevoerd, terwijl het verwerken van inputtokens (de prompt) parallel in één batch kan gebeuren. Dat asymmetrische rekenkosten-verschil is waarom elke grote aanbieder output prijst tegen ruwweg 4-8x het inputtarief.
Hoe weet ik hoeveel tokens mijn prompt gebruikt?
Gebruik de Token Counter-tool van CodeKitHub — plak je daadwerkelijke prompt of systeembericht en hij toont het exacte aantal tokens met de echte tokenizer, in plaats van een ruwe schatting op basis van tekens. Het aantal outputtokens is lastiger vooraf te voorspellen; een redelijke aanpak is de daadwerkelijke gebruikscijfers uit een paar echte API-responses te bekijken en die als schatting te gebruiken.
Zijn deze prijzen gegarandeerd actueel?
Nee — de API-prijzen van AI-aanbieders veranderen vrij vaak, soms met weinig aankondiging vooraf. De prijzen in deze tool zijn rechtstreeks geverifieerd aan de hand van de officiële prijspagina van elke aanbieder op de datum die bij de calculator wordt getoond. Controleer voordat je een budget- of aankoopbeslissing neemt zelf de actuele pagina: OpenAI-prijzen (developers.openai.com/api/docs/pricing), Anthropic/Claude-prijzen (platform.claude.com/docs/en/about-claude/pricing), en Google Gemini-prijzen (ai.google.dev/gemini-api/docs/pricing).
Waarom staat [mijn favoriete model] niet in de lijst?
Deze tool omvat een representatieve budget-/mid-tier-/topspreiding van OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu en xAI (19 modellen in totaal) in plaats van elk model dat elke aanbieder biedt, om de lijst overzichtelijk en de prijsdata makkelijk actueel te houden. Als je een model nodig hebt dat niet vermeld staat, controleer dan de prijs per 1M tokens op de pagina van de aanbieder en doe dezelfde rekensom van inputkosten + outputkosten met de hand.
Houdt de prijs van Gemini 3.1 Pro Preview rekening met lange prompts?
Nee — de getoonde prijs is Google's tier tot en met 200.000 tokens. De prijzen van Gemini stappen omhoog voor prompts die die drempel overschrijden, en deze calculator modelleert die toeslag niet, om de tool eenvoudig te houden. Als je prompts regelmatig langer zijn dan 200k tokens, controleer dan de prijspagina van Google voor het exacte long-context-tarief.
Zijn de prijzen van DeepSeek, Qwen, Kimi en GLM in USD?
Ja — alle prijzen in deze tool, inclusief de Chinese modellen, zijn de officiële internationale API-tarieven in USD, zodat elk model op dezelfde basis vergeleken kan worden. Sommige van deze aanbieders bieden ook in CNY gefactureerde consoles voor accounts op het Chinese vasteland tegen andere (vaak lagere) tarieven; controleer de eigen console van de aanbieder als je in CNY factureert.
Moet ik optimaliseren op inputkosten of outputkosten?
Kijk naar de vorm van je workload. Als die input-zwaar is — lange documenten erin, korte antwoorden eruit (classificatie, extractie, RAG) — dan domineren de inputprijzen en prompt-caching je rekening. Als die output-zwaar is — lange generaties uit korte prompts — dan is outputprijs het belangrijkst, en outputtokens kosten doorgaans meerdere keren zoveel per token als input bij hetzelfde model.