Wat kost een AI API per miljoen tokens in 2026?
Een AI API kost meestal tussen ongeveer €1 en €25 per miljoen tokens, afhankelijk van het gekozen model en of het gaat om input- of outputtokens. Goedkope modellen van Google, OpenAI en Anthropic zitten vaak onder de €5 per miljoen tokens, terwijl de krachtigste modellen kunnen oplopen tot €50 per miljoen outputtokens. Het model bepaalt verreweg het grootste deel van de rekening.
DitKost.nl
Gemiddeld richtbedrag: €2 tot €15 per miljoen inputtokens
Realistische prijsrange: €1 tot €25 per miljoen tokens
Hoge prijs: tot circa €50 per miljoen outputtokens
Belangrijkste prijsbepaler: gekozen AI-model

Wat betekent een miljoen tokens eigenlijk?
Veel ontwikkelaars kijken naar het prijskaartje per miljoen tokens zonder precies te weten hoeveel tekst dat vertegenwoordigt. Een token is geen woord. Gemiddeld bestaat één token uit ongeveer drie tot vier tekens tekst.
Een miljoen tokens komt grofweg overeen met:
| Hoeveelheid | Ongeveer |
|---|---|
| Woorden | 700.000 tot 800.000 |
| A4-pagina’s | 1.500 tot 2.000 |
| Boeken | 8 tot 12 gemiddelde boeken |
Daardoor klinkt een miljoen tokens enorm, maar voor een chatbot, AI-assistent of klantenservice kan dat volume verrassend snel worden bereikt.
Wat kost 1 miljoen tokens bij bekende AI-aanbieders?
De meeste aanbieders rekenen afzonderlijke tarieven voor invoer en uitvoer. Inputtokens zijn de tekst die je naar het model stuurt. Outputtokens zijn het antwoord dat het model terugstuurt.
Onderstaande prijzen zijn gebaseerd op actuele officiële prijsinformatie van OpenAI, Anthropic en Google.
| Model | Input per 1 miljoen tokens | Output per 1 miljoen tokens |
|---|---|---|
| OpenAI GPT-5.6 Terra | $2 | $12 |
| OpenAI GPT-5.6 Sol | $4 | $20 |
| Claude Sonnet 5 | $2 | $10 |
| Claude Opus 5 | $5 | $25 |
| Claude Fable 5.1 | $10 | $50 |
| Gemini 3.8 Flash | $0,75 | $3,75 |
| Gemini 3.1 Pro | $2 | $12 |
Daar zit meteen een belangrijk verschil. Het goedkoopste model in deze vergelijking kost minder dan één dollar per miljoen inputtokens, terwijl het duurste model voor output boven de vijftig dollar uitkomt.
Voor veel toepassingen is de kwaliteit van het model belangrijker dan de laagste tokenprijs. Een model dat een taak in één poging goed uitvoert, kan uiteindelijk goedkoper zijn dan een goedkoop model dat meer correcties nodig heeft.
Waarom zijn outputtokens duurder?
Op vrijwel iedere prijspagina zie je dat output duurder is dan input. Dat komt doordat het genereren van nieuwe tekst meer rekenkracht vraagt dan het verwerken van aangeleverde tekst.
Bij Claude Sonnet 5 betaal je bijvoorbeeld ongeveer $2 voor een miljoen inputtokens en $10 voor een miljoen outputtokens. Het antwoord kost dus vijf keer zoveel als de prompt.
Dat verschil heeft directe invloed op de maandrekening. Een AI-agent die lange rapporten schrijft of uitgebreide analyses genereert, produceert veel outputtokens. Een systeem dat vooral documenten analyseert en korte antwoorden teruggeeft gebruikt relatief weinig output en blijft daardoor goedkoper.
Een praktisch rekenvoorbeeld
Stel dat je een klantenservicechatbot bouwt voor een webshop.
Gemiddeld gesprek:
- 1.000 inputtokens
- 500 outputtokens
Per gesprek verbruik je dan ongeveer 1.500 tokens.
Bij 10.000 gesprekken per maand komt dat neer op:
| Verbruik | Aantal |
|---|---|
| Inputtokens | 10 miljoen |
| Outputtokens | 5 miljoen |
| Totaal | 15 miljoen |
Gebruik je een model zoals Claude Sonnet 5 met tarieven van ongeveer $2 input en $10 output per miljoen tokens, dan ziet de maandrekening er ongeveer zo uit:
| Onderdeel | Kosten |
|---|---|
| 10 miljoen inputtokens | $20 |
| 5 miljoen outputtokens | $50 |
| Totaal | $70 |
Voor veel websites blijkt de AI-rekening dus aanzienlijk lager dan verwacht. Niet de API, maar ontwikkeling, integratie en onderhoud vormen vaak de grootste kostenpost.
Wanneer loopt de rekening echt op?
Een miljoen tokens klinkt veel, maar bepaalde toepassingen gebruiken enorme volumes.
Dat zie je vooral bij:
- AI-klantenservice met duizenden gesprekken per dag
- AI-agents die zelfstandig taken uitvoeren
- Contentgeneratie op grote schaal
- Documentanalyse van grote datasets
- Programmeerassistenten die complete codebases verwerken
Een AI-agent die maandelijks 100 miljoen inputtokens en 50 miljoen outputtokens gebruikt op een model van $2 input en $12 output kost ongeveer:
- Input: $200
- Output: $600
Totaal: circa $800 per maand.
Voor een middelgrote organisatie is dat vaak nog steeds lager dan een extra medewerker, maar het laat wel zien hoe belangrijk modelkeuze wordt wanneer volumes stijgen.
Welke keuze past bij welk budget?
Niet iedere toepassing heeft een krachtig premiummodel nodig.
Voor eenvoudige classificatie, samenvattingen en automatische verwerking van tekst blijken goedkopere modellen vaak voldoende. De prijs per miljoen tokens blijft dan meestal onder enkele euro’s.
Voor complexe analyses, softwareontwikkeling of AI-agents wordt vaker gekozen voor modellen uit het hogere segment. De kosten per miljoen tokens liggen dan hoger, maar het model levert doorgaans betere resultaten en minder foutieve antwoorden.
De grootste fout is vaak om direct met een duur model te beginnen zonder te testen of een goedkoper model hetzelfde resultaat levert.

Wie zich verdiept in de totale kosten van kunstmatige intelligentie vindt op wat kost AI een breder overzicht van abonnementen, implementaties en API-gebruik.
Wat bepaalt de uiteindelijke API-kosten?
De tokenprijs vertelt slechts een deel van het verhaal.
Deze factoren hebben meestal de meeste invloed:
- Het model dat je gebruikt.
- Het aantal gebruikers of gesprekken.
- De lengte van prompts.
- De lengte van antwoorden.
- Eventuele caching.
- Batchverwerking.
- Extra functies zoals zoeken, afbeeldingen of tools.
Vooral lange prompts kunnen onverwacht duur uitvallen. Bij sommige AI-projecten wordt dezelfde uitgebreide systeemprompt bij ieder verzoek meegestuurd. Daardoor groeit het aantal inputtokens sneller dan nodig is.
Wat is een normale prijs voor een AI API?
Voor een kleine website, eenvoudige chatbot of interne AI-tool blijven de maandelijkse API-kosten vaak beperkt tot enkele euro’s tot enkele tientallen euro’s per maand.
Voor een actieve zakelijke toepassing liggen de kosten meestal tussen €50 en €1.000 per maand.
Grotere AI-platformen en agentoplossingen kunnen duizenden euro’s per maand aan tokens verbruiken, maar dan gaat het meestal om tientallen tot honderden miljoenen tokens per maand.
De prijs per miljoen tokens is daarom vooral een hulpmiddel om verschillende modellen eerlijk te vergelijken. De werkelijke rekening wordt bepaald door het totale verbruik.
Conclusie
Wat kost een AI API per miljoen tokens? Op basis van actuele tarieven ligt een realistische prijs tegenwoordig tussen ongeveer $1 en $25 per miljoen tokens voor gangbare modellen. Goedkope modellen van Google zitten daar ruim onder, terwijl de krachtigste modellen van Anthropic en OpenAI kunnen oplopen tot ongeveer $50 per miljoen outputtokens.
Voor veel bedrijven blijken de daadwerkelijke API-kosten lager dan verwacht. De keuze van het model en de hoeveelheid gegenereerde output hebben meestal veel meer invloed op de rekening dan het aantal gebruikers alleen.
Bronnen en prijscontrole
- OpenAI API Pricing – actuele tokenprijzen van OpenAI
- Anthropic Claude Pricing – actuele tokenprijzen van Claude
- Google Gemini API Pricing – actuele Gemini API-prijzen
- OpenAI Developer Documentation – prijsstructuur en caching
- Anthropic Documentation – uitleg input en outputtokens
Totaal gebruikte bronnen: 5.
