Rekenhulp
Met deze token calculator reken je zelf uit wat een prompt of een hele AI-toepassing kost. Je hebt drie getallen nodig: hoeveel tokens erin gaan, hoeveel eruit komen en de prijs van het model. Hieronder staan de formule, vuistregels om tokens te schatten en een tabel met uitgerekende voorbeelden voor de bekendste modellen, prijspeil september 2026.
De rekenhulp
Kosten per taak = (invoertokens × invoerprijs + uitvoertokens × uitvoerprijs) ÷ 1.000.000
De prijzen van AI-modellen staan per miljoen tokens. Vul de formule in drie stappen in:
Vermenigvuldig de kosten per taak met het aantal keer per maand, en je hebt je maandbedrag.
| Wat | Ongeveer |
|---|---|
| 1 token in het Engels | 4 tekens, driekwart woord |
| 100 woorden Engels | 130 tokens |
| 100 woorden Nederlands | 145 tot 190 tokens |
| Een zakelijke mail van 200 woorden | 300 tot 400 tokens |
| Een A4 tekst van 500 woorden | 750 tot 1.000 tokens |
| Een rapport van 10 pagina's | 7.500 tot 10.000 tokens |
De Engelse vuistregel komt van OpenAI. Voor Nederlands is het aantal tokens per woord hoger, en het verschilt per model. Een telling van 45.000 woorden Nederlandse tekst met de open tokenizer van OpenAI, tiktoken, in september 2026: de tokenizer van GPT-4o en GPT-5 gaf 145 tokens per 100 woorden, de oudere tokenizer van GPT-4 189. Claude en Gemini hebben een eigen tokenizer, daar kan het anders uitvallen. Wil je het precies weten, laat de aanbieder dan tellen. Anthropic heeft daar bijvoorbeeld een functie voor in de API.
Uitgerekend
Twee voorbeelden, uitgerekend met de prijzen van de sites van de aanbieders. Prijspeil september 2026, bedragen in dollars exclusief btw.
Taak A: een klantmail beantwoorden. 1.000 tokens invoer (instructies plus mail), 300 tokens uitvoer. Kosten per 1.000 mails.
Taak B: een rapport van 10 pagina's samenvatten. 8.000 tokens invoer, 500 tokens uitvoer. Kosten per 100 rapporten.
| Model | Prijs invoer / uitvoer per miljoen | Taak A, 1.000 mails | Taak B, 100 rapporten |
|---|---|---|---|
| GPT-6 Luna | $0,10 / $0,50 | $0,25 | $0,11 |
| Gemini 3.1 Flash-Lite | $0,25 / $1,50 | $0,70 | $0,28 |
| Claude Haiku 4.5 | $1 / $5 | $2,50 | $1,05 |
| Claude Sonnet 5 | $2 / $10 | $5,00 | $2,10 |
| GPT-6 Sol | $2 / $10 | $5,00 | $2,10 |
| Claude Opus 5.5 | $4 / $20 | $10,00 | $4,20 |
| GPT-6 Astra | $10 / $50 | $25,00 | $10,50 |
De kosten per losse prompt zijn dus bijna altijd een fractie van een cent. Het gaat pas tellen bij volume: tienduizenden mails per maand, of een toepassing die bij elke vraag een groot document meestuurt. Actuele prijzen per model staan in onze stukken over Claude-prijzen en LLM-kosten.
Let op
In de praktijk valt de rekening vaak hoger uit dan de formule voorspelt. Dat komt door tokens die je niet direct ziet.
Daar staat tegenover dat de meeste aanbieders korting geven op invoer die vaak hetzelfde is, zoals vaste instructies. Dat heet caching en kan de invoerkosten flink verlagen.
Voorbeeld
Een webwinkel krijgt 3.000 klantmails per maand en wil een AI-toepassing die conceptantwoorden schrijft. Per mail gaat er een vaste instructie van 800 tokens mee, de mail zelf is gemiddeld 250 tokens en er gaat productinformatie van 1.000 tokens mee. Het antwoord is ongeveer 300 tokens.
| Onderdeel | Tokens per mail | Per maand |
|---|---|---|
| Invoer | 2.050 | 6,15 miljoen |
| Uitvoer | 300 | 0,9 miljoen |
Met Claude Sonnet 5 ($2 / $10): 6,15 × 2 + 0,9 × 10 = $12,30 + $9,00 = $21,30 per maand.
Met GPT-6 Luna ($0,10 / $0,50): 6,15 × 0,10 + 0,9 × 0,50 = $0,62 + $0,45 = ongeveer $1,07 per maand.
De modelkosten zijn in dit voorbeeld dus klein. De echte kosten zitten in het bouwen, koppelen en onderhouden van de toepassing, en in de tijd die medewerkers besteden aan controleren. Test daarom eerst of het goedkope model goed genoeg is voor je taak. Voor veel vaste taken is dat zo.
Keuze
| Taak | Welk soort model |
|---|---|
| Mails sorteren, gegevens uit formulieren halen, korte samenvattingen | Klein en goedkoop, zoals Luna, Flash-Lite of Haiku |
| Klantantwoorden, teksten schrijven, documenten vergelijken | Middenklasse, zoals Sonnet of Sol |
| Lastige analyses, lange redeneringen, code | Groot model, zoals Opus of Astra |
In de toepassingen die wij bouwen combineren we vaak twee modellen: een klein model sorteert en doet het meeste werk, een groot model pakt alleen de lastige gevallen. Zo blijft de rekening laag zonder in te leveren op kwaliteit waar het ertoe doet. Hoe zo'n model werkt en waarom het in tokens rekent, lees je in wat is een LLM.
willen we later een echte invultool op deze pagina? Tot die tijd blijft het een rekenhulp met formule en tabel.
Veelgestelde vragen
Een stukje tekst waarin een AI-model tekst opknipt, vaak een deel van een woord. In het Engels is een token gemiddeld ongeveer vier tekens. Aanbieders rekenen per miljoen tokens.
Het model moet elk token van het antwoord los berekenen, terwijl de invoer in één keer wordt verwerkt. Bij de grote aanbieders is uitvoer daardoor vaak vijf keer zo duur.
Nee. Een abonnement heeft een vaste prijs per maand met gebruikslimieten. De prijs per token geldt voor de API, die je gebruikt als je AI in je eigen software of koppelingen inbouwt.
De meeste aanbieders hebben een tokenizer of een telfunctie in hun API. Omdat elk model anders telt, is de telling van het model dat je gebruikt de enige exacte.
Verder lezen
In een strategiegesprek rekenen we met je eigen aantallen uit wat een toepassing kost en wat hij oplevert.