Compteur de Tokens IA — GPT, Claude et Gemini
≈ estimation · compatible GPT-4 / Claude / Gemini
Qu'est-ce que Compteur de Tokens IA — GPT, Claude et Gemini
Un compteur de tokens estime combien de tokens un texte utilise lorsqu'il est traité par des grands modèles de langage (LLM) comme GPT-4, Claude ou Gemini. Les tokens sont l'unité fondamentale que les modèles IA utilisent pour lire le texte — environ 1 token pour 4 caractères, soit environ 0,75 token par mot en anglais. Connaître le nombre de tokens est essentiel pour rédiger des prompts, construire des pipelines RAG ou rester dans les limites de la fenêtre de contexte afin d'éviter les troncatures et de contrôler les coûts d'API.
Comment utiliser
- Collez ou saisissez n'importe quel texte dans le champ de saisie — prompts, documents, code ou historique de conversation.
- Lisez le nombre de tokens instantanément dans la carte bleue en haut.
- Vérifiez les barres d'utilisation du contexte pour voir quel pourcentage des fenêtres de contexte de GPT-4 (128k) et Claude (200k) votre texte occupe.
- Utilisez les comptages de caractères et de mots comme référence supplémentaire.
Quand l'utiliser
Vous montez un chatbot RAG et vous vous demandez si le chunk récupéré plus le prompt système tiennent dans la fenêtre de 128k de GPT-4 ? Collez le texte combiné et vous voyez qu'il utilise 4 200 tokens (3,3% de la limite), donc il vous reste largement de place pour la réponse du modèle avant d'appeler l'API. Pratique pour élaguer vos prompts, dimensionner vos chunks et estimer le coût par appel.
Questions fréquentes
Quelle est la précision de ce compteur de tokens ?
Cet outil utilise une heuristique compatible BPE (environ 4 caractères par token pour l'anglais) et est précis à ±10% pour du texte anglais typique. Pour des comptages exacts, utilisez la bibliothèque tiktoken officielle d'OpenAI. Les scripts non latins, le code et les textes très ponctués peuvent varier davantage.
Qu'est-ce qu'un token dans les modèles IA ?
Un token est un morceau de texte qu'un modèle IA traite comme une unité. Il peut s'agir d'un mot entier, d'une partie de mot ou d'un seul caractère. Les mots courants comme 'the' comptent pour un token ; les mots plus longs peuvent être découpés en plusieurs tokens. La plupart des LLM facturent l'usage de l'API par tokens consommés.
Qu'est-ce qu'une fenêtre de contexte ?
Une fenêtre de contexte est le nombre maximum de tokens qu'un modèle peut traiter en une seule requête — incluant votre prompt, l'historique de conversation, les documents récupérés et la réponse du modèle. GPT-4 Turbo prend en charge 128k tokens ; Claude 3 jusqu'à 200k. Dépasser cette limite amène le modèle à tronquer le contenu plus ancien.
Pourquoi différents modèles ont-ils des comptages de tokens différents pour le même texte ?
Chaque modèle utilise son propre tokeniseur (vocabulaire de tokens BPE). Les modèles OpenAI utilisent tiktoken ; Claude utilise le tokeniseur interne d'Anthropic ; Gemini utilise SentencePiece. Les différences sont généralement faibles (5–15%) pour du texte anglais, mais peuvent être plus importantes pour d'autres langues.
Mon texte est-il envoyé à un serveur ?
Non. Tout le comptage s'effectue dans votre navigateur avec JavaScript. Votre texte ne quitte jamais votre appareil.
Puis-je partager cet outil avec mes données pré-remplies ?
Oui. L'URL se met à jour pendant que vous tapez. Copiez le lien depuis la barre d'adresse ou utilisez le bouton Partager — quiconque l'ouvre verra vos données déjà remplies.
Outils connexes
Découpeur de Texte IA — RAG et Embeddings
Découpez du texte en segments pour les pipelines RAG et les embeddings LLM. Définissez la taille par tokens ou caractères avec chevauchement optionnel. Outil gratuit en ligne.
Encodeur et Décodeur du Chiffre Atbash
Encodez et décodez le chiffre Atbash en ligne. Atbash inverse l'alphabet et est son propre inverse, un clic brouille et débrouille donc. Gratuit et privé.
Supprimer l'Arrière-Plan d'une Image
Supprimez l'arrière-plan de n'importe quelle image en ligne et obtenez un PNG transparent. Tourne dans votre navigateur avec l'IA. Gratuit.