Ga naar de inhoud

Kosten van AI

Wat kost een LLM? Kosten per gebruik uitgelegd

LLM kosten reken je via de API per token: je betaalt voor de tekst die je naar het model stuurt en, duurder, voor de tekst die het terugschrijft. De prijzen lopen uiteen van enkele dubbeltjes tot tientallen dollars per miljoen tokens. Voor de meeste mkb-toepassingen gaat het om enkele euro's tot enkele honderden euro's per maand. Hieronder de actuele prijzen en hoe je het zelf uitrekent.

In het kort

  • Via de API betaal je per miljoen tokens. Uitvoer is vijf tot zes keer zo duur als invoer.
  • Een token is een stukje tekst. Voor Engels rekent Anthropic met ongeveer 0,75 woord per token. De telling verschilt per taal en model.
  • Het verschil tussen een klein en een groot model is al snel een factor 20 of meer in prijs.
  • Met batchverwerking en prompt caching betaal je bij alle drie de grote aanbieders fors minder.

LLM kosten: zo werkt betalen per token

Als je een taalmodel via de API gebruikt, dus gekoppeld aan je eigen software, betaal je per gebruik. De eenheid is de token: een stukje tekst van een woord of een deel van een woord. Wat een LLM precies is en hoe tokens werken, lees je in wat is een LLM.

Je betaalt voor twee soorten tokens:

Prijzen staan per miljoen tokens (MTok) en in dollars. Anthropic geeft als vuistregel dat 1 token ongeveer 4 tekens of 0,75 woord Engelse tekst is, en dat de telling per taal en soort inhoud verschilt. Ook verschilt de telling per model: Anthropic meldt dat de tokenizer van zijn nieuwere modellen ongeveer 30 procent meer tokens maakt van dezelfde tekst. Een paar vergelijkbare prijzen per token zeggen dus niet alles. Tel het na met je eigen teksten, bijvoorbeeld met onze token calculator.

Wat kost een AI model per token? Actuele API-prijzen

Prijzen per miljoen tokens in dollars, standaard verwerking, zoals op de officiële prijspagina's in september 2026. Aanbieders passen hun prijzen regelmatig aan, dus controleer ze voordat je rekent.

ModelAanbiederInvoerUitvoer
GPT-6 AstraOpenAI$10,00$50,00
GPT-6 SolOpenAI$2,00$10,00
GPT-6 LunaOpenAI$0,10$0,50
Claude Opus 5.5Anthropic$4,00$20,00
Claude Sonnet 5Anthropic$2,00$10,00
Claude Haiku 4.5Anthropic$1,00$5,00
Gemini 3.1 Pro Preview (tot 200.000 tokens)Google$2,00$12,00
Gemini 3.8 FlashGoogle$0,75$3,75
Gemini 3.1 Flash-LiteGoogle$0,25$1,50

Twee dingen vallen op. Het grootste model is 100 keer zo duur als het kleinste in deze lijst. En Google heeft aangekondigd dat de Flash-modellen van de 3.6-, 3.7- en 3.8-reeks per 1 januari 2027 twee keer zo duur worden: $1,50 voor invoer en $7,50 voor uitvoer.

De ranglijst van wat goedkoop is, verandert elke paar maanden. Kies daarom niet op prijs alleen. Een goedkoop model dat vaker fouten maakt, kost je meer tijd aan controle.

Rekenvoorbeelden uit de praktijk

Zo reken je het uit: (aantal invoertokens × invoerprijs + aantal uitvoertokens × uitvoerprijs) / 1.000.000.

Voorbeeld 1: 1.000 klantmails per maand

Per mail stuur je de mail zelf, je instructies en wat productinformatie mee: ongeveer 1.500 tokens. Het concept-antwoord is ongeveer 300 tokens. Per maand is dat 1,5 miljoen tokens invoer en 0,3 miljoen uitvoer.

ModelKosten per maand
GPT-6 Luna$0,30
Claude Haiku 4.5$3,00
Claude Sonnet 5$6,00
Claude Opus 5.5$12,00

Voorbeeld 2: 10.000 facturen per maand uitlezen

Per factuur ongeveer 3.000 tokens invoer en 500 tokens uitvoer in een vaste structuur. Dat is 30 miljoen invoer en 5 miljoen uitvoer.

ModelStandaardMet batch (50 procent korting)
Gemini 3.1 Flash-Lite$15,00$7,50
Claude Sonnet 5$110,00$55,00
GPT-6 Astra$550,00$275,00

Anthropic noemt zelf een vergelijkbaar voorbeeld: 10.000 klantenservicegesprekken van gemiddeld 3.700 tokens kosten met Claude Haiku 4.5 ongeveer $37.

De les: de tokenkosten zijn bij de meeste mkb-toepassingen klein vergeleken met de uren die je bespaart. Het wordt pas duur bij grote volumes met een groot model, of bij AI agents die per taak tientallen stappen zetten en steeds de hele context opnieuw meesturen.

Zo betaal je minder: batch en caching

Er zijn vier manieren om de API kosten van AI te verlagen. De eerste twee bieden alle drie de grote aanbieders aan.

  1. Batchverwerking. Stuur verzoeken die niet direct antwoord nodig hebben als pakket. Je krijgt het resultaat later, meestal binnen een dag, en betaalt 50 procent minder. Handig voor facturen, productteksten of rapportages die 's nachts mogen draaien.
  2. Prompt caching. Stuur je steeds dezelfde lange instructies of hetzelfde document mee, dan onthoudt de aanbieder dat deel. Bij Anthropic kost een cache-hit 10 procent van de gewone invoerprijs, bij Claude Opus 5.5 zelfs 5 procent. Bij OpenAI is het gecachete tarief voor de GPT-6-modellen ook een tiende van de gewone invoerprijs.
  3. Het juiste model per taak. Laat een klein model sorteren en samenvatten, en roep alleen voor de lastige gevallen een groot model aan.
  4. Kortere invoer. Stuur alleen de relevante stukken van je documenten mee. Dat is precies wat RAG doet.

Let ook op extra's. Wie gegevens verplicht binnen een bepaalde regio wil laten verwerken, betaalt bij OpenAI voor nieuwere modellen 10 procent extra. Anthropic rekent 10 procent extra als je verwerking in de VS vastlegt. Zoeken op internet via de API kost bij Anthropic $10 per 1.000 zoekopdrachten, bovenop de tokens.

API of abonnement?

Abonnement per gebruiker

  • Vast bedrag per persoon per maand
  • Geschikt voor medewerkers die zelf chatten
  • Geen koppeling met je eigen systemen
  • Voorspelbare kosten, ook bij weinig gebruik
  • Zie ChatGPT zakelijk en Claude prijzen

API per token

  • Je betaalt alleen wat je gebruikt
  • Geschikt voor koppelingen en automatische processen
  • Werkt in je eigen software, mail of ERP
  • Kosten stijgen mee met volume
  • Vraagt een ontwikkelaar of automatiseringstool

Wat het in onze projecten kost

In de trajecten die we bouwen, zijn de token kosten zelden de grootste post. De bouw van de koppeling, het testen op je eigen data en het beheer kosten meer dan het rekenwerk van het model. Bij Sucre & Co scheelt de automatisering 80 uur handwerk per week. Tegen zo'n besparing vallen de modelkosten in het niet.

Wat zijn in een typisch ShareConnect-project de maandelijkse API-kosten van het taalmodel, bijvoorbeeld bij de orderverwerking van Sucre & Co? Mogen we een bedrag of bandbreedte noemen?

Wil je weten wat een complete oplossing kost, inclusief bouw en beheer, lees dan wat kost AI voor een mkb-bedrijf. Gaat het om gevoelige gegevens, dan kan een model op je eigen server een alternatief zijn. Daar betaal je niet per token maar voor hardware en beheer. Zie een LLM lokaal draaien.

Veelgemaakte fouten

Uit de praktijk

Veelgestelde vragen

Wat kost een LLM per maand?

Dat hangt af van het volume en het model. Duizend klantmails per maand kosten met een middelgroot model enkele dollars. Tienduizend facturen uitlezen kost met een klein model rond de 15 dollar en met een groot model een paar honderd dollar. Bouw en beheer van de koppeling kosten meestal meer dan de tokens.

Wat zijn tokenkosten?

Tokenkosten zijn wat je betaalt per stukje tekst dat een taalmodel verwerkt. Je betaalt apart voor invoer, de tekst die je stuurt, en uitvoer, de tekst die het model schrijft. Prijzen staan per miljoen tokens.

Hoeveel tokens is een woord?

Anthropic rekent voor Engelse tekst met ongeveer 0,75 woord per token, oftewel ongeveer 4 tekens. Voor andere talen en per model verschilt dat. Tel het na met een tokenteller op je eigen teksten.

Is de API goedkoper dan een abonnement?

Voor koppelingen en automatische processen meestal wel, omdat je alleen betaalt wat je gebruikt. Voor medewerkers die de hele dag zelf met AI werken, is een abonnement per gebruiker vaak voorspelbaarder. Veel bedrijven gebruiken allebei.

Hoe verlaag ik de API kosten van AI?

Gebruik een kleiner model waar het kan, stuur alleen relevante tekst mee, zet batchverwerking in voor taken die niet haasten en gebruik prompt caching voor vaste instructies. Batch geeft bij de grote aanbieders 50 procent korting.

Verder lezen

Meer uit de kennisbank

Bronnen

Geraadpleegd in september 2026.

  1. OpenAI, API pricing. developers.openai.com
  2. Anthropic, Claude API pricing. platform.claude.com
  3. Google, Gemini API pricing. ai.google.dev
Terug naar de kennisbank

Wil je weten wat AI in jouw proces kost en oplevert?

We rekenen het uit met je eigen volumes: tokens, bouw, beheer en de uren die je terugkrijgt.

1 open vraag