Jitt/ AI
Terug naar blog

AI uitleg

Wat is een AI-token, en waar wordt het voor gebruikt?

Een token is een stukje tekst waarmee een AI-model rekent. Vaak is dat ongeveer een woord, soms een deel van een woord of een leesteken. Een AI leest geen letters en geen hele woorden zoals wij: hij hakt tekst eerst in tokens en werkt daarmee verder.

Auteur
Jitt AI Automation
Gepubliceerd op
Leestijd
3 min lezen
Wat is een AI-token, en waar wordt het voor gebruikt?

Hoe tekst in tokens wordt opgeknipt

Het opknippen van tekst in tokens heet tokenisatie. Grofweg werkt het zo:

  • Een kort, gewoon woord is meestal 1 token — bijvoorbeeld boom.
  • Een langer woord wordt vaak in meer tokens opgeknipt — bijvoorbeeld onwaarschijnlijk in 3 stukjes: on · waarschijn · lijk.
  • Ook spaties en leestekens tellen mee als (deel van) een token.

Let op: dit zijn illustraties, geen vaste regels. Hoe een woord precies wordt opgeknipt verschilt per model, dus het exacte aantal tokens ligt niet vast.

Wat je verstuurt én wat je terugkrijgt telt mee

Niet alleen wat je náár de AI stuurt telt als tokens, maar ook wat je terugkrijgt. Je vraag wordt in tokens omgezet, de AI denkt na, en produceert zelf weer tokens die als antwoord teruggezet worden in tekst.

Een vraag van de gebruiker wordt omgezet in tokens, gaat naar het AI-model, dat een antwoord in tokens teruggeeft dat weer tekst wordt voor de gebruiker.

Zowel je vraag als het antwoord bestaat uit tokens. Allebei tellen mee.

Waarom dezelfde tekst per model verschilt

Omdat elk model een eigen tokenizer gebruikt. Dat is het stuk software dat tekst opknipt, en elke tokenizer doet dat op zijn eigen manier. Dezelfde zin wordt bij GPT, Llama, Qwen of Gemini dus in een ander aantal tokens verdeeld.

Twee dingen om te onthouden:

  • Ongewone woorden worden vaker opgeknipt. Bekende woorden blijven meestal heel, zeldzame worden in meer stukjes verdeeld.
  • Niet-Engelse tekst kost bij veel tokenizers meer tokens. Veel modellen zijn vooral op Engelse tekst getraind, dus talen als het Nederlands worden vaak in kleinere stukjes gehakt. Dat is geen wet, maar het komt regelmatig voor.

Wanneer het je geld kost

Tokens zijn vooral relevant als je een AI via een API gebruikt, bijvoorbeeld als je software rechtstreeks met een model praat. Dan reken je meestal per token af, en vaak met twee tarieven:

  • Wat je erin stopt (je vraag, plus alle context die je meestuurt).
  • Wat de AI teruggeeft (het antwoord). Dit is vaak duurder.

Een paar actuele voorbeeldtarieven, per 1 miljoen tokens:

ModelInputOutput
GPT-5.1$1,25 / 1M tokens$10,00 / 1M tokens
Claude Opus 5.5$4,00 / 1M tokens$20,00 / 1M tokens
Gemini 2.5 Flash$0,30 / 1M tokens$2,50 / 1M tokens
Mistral Large 3$0,50 / 1M tokens$1,50 / 1M tokens

Dit zijn API-prijzen van september 2026; aanbieders kunnen ze later wijzigen. Je ziet in elke rij dat output duurder is dan input.

Een simpel rekenvoorbeeld. Stel je gebruikt Gemini 2.5 Flash en verstuurt in totaal 1 miljoen inputtokens en ontvangt 1 miljoen outputtokens. Dan kost dat ongeveer $0,30 + $2,50 = $2,80.

Verder lezen