AI Token Teller — GPT, Claude & Gemini
≈ schatting · compatibel met GPT-4 / Claude / Gemini
Wat is het AI Token Teller — GPT, Claude & Gemini
Een tokenteller schat hoeveel tokens een stuk tekst gebruikt wanneer het wordt verwerkt door grote taalmodellen (LLM's) zoals GPT-4, Claude of Gemini. Tokens zijn de basiseenheid waarmee AI-modellen tekst lezen — ruwweg 1 token per 4 tekens, of ongeveer 0,75 token per woord in het Engels. Je tokenaantal kennen is essentieel bij het schrijven van prompts, het bouwen van RAG-pijplijnen of het binnen contextvensterlimieten blijven om afkapping te vermijden en API-kosten te beheersen.
Hoe te gebruiken
- Plak of typ elke tekst in het invoerveld — prompts, documenten, code of gespreksgeschiedenis.
- Lees het tokenaantal direct af in de blauwe kaart bovenaan.
- Bekijk de contextgebruiksbalken om te zien welk percentage van de contextvensters van GPT-4 (128k) en Claude (200k) je tekst vult.
- Gebruik het teken- en woordaantal als extra referentie.
Wanneer te gebruiken
Bouw je een RAG-chatbot en vrees je dat een opgehaald stuk plus je systeemprompt niet in het contextvenster van 128k van GPT-4 past? Plak de gecombineerde tekst en je ziet dat het 4.200 tokens gebruikt (3,3% van de limiet), zodat je weet dat er ruim plaats is voor het antwoord van het model voordat je de API aanroept. Handig om prompts in te korten, stukken te dimensioneren en kosten per aanroep te schatten.
Veelgestelde vragen
Hoe nauwkeurig is deze tokenteller?
Deze tool gebruikt een BPE-compatibele heuristiek (ongeveer 4 tekens per token voor Engels) en is nauwkeurig binnen ±10% voor typische Engelse tekst. Gebruik voor exacte tellingen de officiële tiktoken-library van OpenAI. Niet-Engelse schriften, code en zwaar geïnterpuncteerde tekst kunnen meer variëren.
Wat is een token in AI-modellen?
Een token is een stuk tekst dat een AI-model als eenheid verwerkt. Het kan een heel woord, een deel van een woord of een enkel teken zijn, afhankelijk van het woord. Veelvoorkomende woorden als 'the' zijn één token; langere of ongebruikelijke woorden kunnen in meerdere tokens worden gesplitst. De meeste LLM's factureren API-gebruik op verbruikte tokens.
Wat is een contextvenster?
Een contextvenster is het maximale aantal tokens dat een model in één verzoek kan verwerken — inclusief je prompt, gespreksgeschiedenis, opgehaalde documenten en het antwoord van het model. GPT-4 Turbo ondersteunt 128k tokens; Claude 3 ondersteunt tot 200k. Deze limiet overschrijden zorgt ervoor dat het model oudere inhoud afkapt.
Waarom hebben verschillende modellen verschillende tokenaantallen voor dezelfde tekst?
Elk model gebruikt zijn eigen tokenizer (vocabulaire van BPE-tokens). OpenAI-modellen gebruiken tiktoken; Claude gebruikt de interne tokenizer van Anthropic; Gemini gebruikt SentencePiece. De verschillen zijn meestal klein (5–15%) voor Engelse tekst, maar kunnen groter zijn voor andere talen.
Wordt mijn tekst naar een server gestuurd?
Nee. Al het tellen gebeurt in je browser met JavaScript. Je tekst verlaat je apparaat nooit.
Kan ik deze tool delen met mijn ingevulde gegevens?
Ja. De URL wordt automatisch bijgewerkt terwijl je typt. Kopieer de link uit de adresbalk of gebruik de Deel-knop — iedereen die de link opent, ziet jouw gegevens al ingevuld.
Gerelateerde tools
AI Tekst Splitser — Splits Tekst voor RAG en Embeddings
Splits tekst in stukken voor RAG-pijplijnen en LLM-embeddings. Stel de stukgrootte in op tokens of tekens met optionele overlap. Gratis AI-tekstsplitser online.
Atbash-cijfer-encoder en -decoder
Codeer en decodeer het Atbash-cijfer online. Atbash spiegelt het alfabet en is zijn eigen inverse, dus één klik versleutelt en ontsleutelt. Gratis en privé.
Achtergrond Verwijderen
Verwijder de achtergrond van elke afbeelding online en krijg een transparante PNG. Draait met AI in je browser, je foto wordt nooit geüpload. Gratis.