← Terug naar kennisbank

Slimmer Werken

Wat is een token in AI en waarom zou jij het willen weten?

Wat is een token in AI en waarom zou jij het willen weten?

·

Leestijd: 4 min

In tekstuele AI-tools zoals ChatGPT of Claude ziet het model geen woorden of zinnen — het ziet tokens, kleine stukjes tekst. Het is handig om te begrijpen wat tokens zijn. Ze verklaren waarom sommige AI-sessies snel op raken en waarom bepaalde taken duurder zijn dan andere.

Wat is een token?

Een token is de basiseenheid van tekst voor moderne AI-modellen. Denk aan tokens als lego-steentjes: samen vormen ze woorden, zinnen of zelfs een hele webpagina.

Er is geen vaste regel, maar een veelgebruikte vuistregel is dat één token ongeveer gelijkstaat aan vier tekens. Sommige tokens zijn één letter of spatie, andere zijn hele woorden. Ook links, emoji en speciale tekens tellen mee. Dat betekent: hoe langer of complexer je invoer is, hoe meer tokens je gebruikt.

Hoe werkt tokenisering en waarom maakt dat uit?

AI-modellen hebben een tokeniseringsstap: ze knippen jouw tekst in stukjes en geven elk stukje een nummer. Elk model heeft daar zijn eigen manier voor. Woorden die vaak voorkomen krijgen vaak één token, zeldzamere woorden worden in meerdere tokens gesplitst.

Dit heeft praktische gevolgen voor jou. Als je veel technische termen, lange URL's of code invoert (code is meestal heel 'token-intensief'), verbruik je veel tokens. Ook afbeeldingen of geluid kunnen worden omgezet naar tokens; grotere bestanden gebruiken er meer.

Hoe AI tekst genereert en wat dat kost

Grote taalmodellen werken door telkens het volgende token te voorspellen. Het model leest jouw prompt (de invoer) en voorspelt token na token het antwoord, net zolang tot de reactie klaar is.

Belangrijk om te weten: er zijn twee typen tokens in zo’n sessie — input tokens (wat jij stuurt) en output tokens (wat het model terugstuurt). Het genereren van output kost meestal meer rekenwerk en dus meer geld. Daarom rekenen veel aanbieders per token: jouw kosten tellen samen uit de tokens die het model leest en de tokens die het schrijft.

Contextvenster en redeneer-modellen: wanneer tokens snel opraken

Een contextvenster (context window) is de maximale hoeveelheid tokens die een model tegelijk kan verwerken. Vroegere modellen konden bijvoorbeeld duizenden tokens tegelijk aan, moderne modellen kunnen honderdduizenden of meer verwerken. Toch kun je tegen grenzen aanlopen als je lange gesprekken, volledige documenten of grote codebases tegelijk wilt laten bekijken.

Redeneer-modellen (ook wel "reasoning models" genoemd) maken extra gebruik van tokens. In plaats van meteen één antwoord te geven, werken ze vaak intern stap voor stap aan een oplossing — een zogenaamde "chain of thought" of denkketen. Dat levert vaak betere antwoorden bij lastige vragen of bij programmeren, maar het gebruikt ook veel meer tokens omdat het model in feite veel meer tekst genereert voordat het antwoord verschijnt.

Kort gezegd: als je veel redeneerwerk, veel context of veel code doorzoekt, zul je sneller je token-limiet bereiken en kunnen de kosten hoger uitvallen.

Praktische tips om tokens te besparen en waarde te krijgen

  • Houd je invoer kort en doelgericht. Formuleer je vraag duidelijk, zonder onnodige achtergrondinformatie.

  • Gebruik eenvoudige voorbeelden of steekwoorden als het kan. Dit haalt vaak hetzelfde antwoord met minder tokens.

  • Sla lange historische gesprekken samen. Veel systemen maken automatisch een korte samenvatting (in plaats van de hele tekst) zodat er minder tokens worden gebruikt.

  • Kies het juiste model voor de taak. Gebruik een snel, goedkoop model voor eenvoudige taken en een krachtiger redeneermodel alleen voor complexe problemen. (Als voorbeeld: sommige platforms bieden meerdere modellen; je kunt een licht model gebruiken voor simpele e-mails en een redeneermodel voor codecontrole.)

  • Combineer AI met vaste automatisering. Door AI alleen te gebruiken waar het echt nodig is en routinetaken via vaste regels te automatiseren (deterministic automation — bijvoorbeeld: als er een nieuw formulier binnenkomt, zet dan die gegevens automatisch in een spreadsheet) houd je tokens voor de taken die écht slim moeten zijn.

  • Let op bijzondere invoer zoals lange URL's, code of bestanden. Die slurpen vaak tokens op zonder dat jij er direct grip op hebt.

Conclusie

Tokens zijn simpel gezegd de meeteenheid van wat AI leest en schrijft. Ze bepalen hoeveel een sessie kost en hoe lang een model met jouw gegevens kan werken (het contextvenster). Begrijpen waar tokens naartoe gaan — invoer, redeneerproces en output — helpt jou betere keuzes te maken: je gebruikt goedkopere modellen voor eenvoudige taken, bewaart krachtige modellen voor echte complexiteit, en automatiseert standaardwerk waar mogelijk.

Met een slimme combinatie van vaste automatisering en gerichte inzet van AI kun jij meer waarde halen uit minder tokens, en zo tijd en geld besparen zonder in technische details te duiken.

Vul je e-mail in om dit artikel te lezen

Gratis, geen spam. Je kunt je altijd weer uitschrijven.

Je e-mailadres wordt uitsluitend gebruikt voor updates over de Kennisbank en belangrijke berichten van Relue.