KI-Token-Zähler — GPT, Claude und Gemini
≈ Schätzung · GPT-4 / Claude / Gemini kompatibel
Was ist KI-Token-Zähler — GPT, Claude und Gemini
Ein Token-Zähler schätzt, wie viele Tokens ein Text verbraucht, wenn er von großen Sprachmodellen (LLMs) wie GPT-4, Claude oder Gemini verarbeitet wird. Tokens sind die grundlegende Einheit, die KI-Modelle zum Lesen von Text verwenden — etwa 1 Token pro 4 Zeichen oder ungefähr 0,75 Tokens pro Wort auf Englisch. Die Token-Anzahl zu kennen ist unverzichtbar beim Schreiben von Prompts, beim Aufbau von RAG-Pipelines oder um innerhalb der Kontextfenstergrenzen zu bleiben und Kosten zu kontrollieren.
Verwendung
- Beliebigen Text in das Eingabefeld einfügen oder eintippen — Prompts, Dokumente, Code oder Gesprächsverlauf.
- Token-Anzahl sofort in der blauen Karte oben ablesen.
- Kontextnutzungsbalken prüfen, um zu sehen, wie viel Prozent der Kontextfenster von GPT-4 (128k) und Claude (200k) dein Text belegt.
- Zeichen- und Wortzahl als zusätzliche Referenz nutzen.
Wann ist es nützlich?
Du baust einen RAG-Chatbot und bist dir nicht sicher, ob der abgerufene Chunk plus System-Prompt ins 128k-Kontextfenster von GPT-4 passt? Füge den kombinierten Text ein und du siehst, dass er 4.200 Tokens (3,3% des Limits) belegt, also bleibt reichlich Platz für die Modellantwort, bevor du die API aufrufst. Praktisch, um Prompts zu kürzen, Chunks zu dimensionieren und die Kosten pro Aufruf abzuschätzen.
Häufig gestellte Fragen
Wie genau ist dieser Token-Zähler?
Dieses Tool verwendet eine BPE-kompatible Heuristik (etwa 4 Zeichen pro Token für Englisch) und ist innerhalb von ±10% für typischen englischen Text genau. Für exakte Zählungen die offizielle tiktoken-Bibliothek von OpenAI verwenden. Nicht-lateinische Schriften, Code und stark interpunktierter Text können stärker abweichen.
Was ist ein Token in KI-Modellen?
Ein Token ist ein Textstück, das ein KI-Modell als Einheit verarbeitet. Es kann ein ganzes Wort, ein Teil eines Wortes oder ein einzelnes Zeichen sein. Häufige Wörter wie 'the' zählen als ein Token; längere Wörter können in mehrere Tokens aufgeteilt werden. Die meisten LLMs berechnen die API-Nutzung nach verbrauchten Tokens.
Was ist ein Kontextfenster?
Ein Kontextfenster ist die maximale Anzahl von Tokens, die ein Modell in einer einzelnen Anfrage verarbeiten kann — einschließlich Prompt, Gesprächsverlauf, abgerufener Dokumente und der Modellantwort. GPT-4 Turbo unterstützt 128k Tokens; Claude 3 bis zu 200k. Das Überschreiten dieses Limits führt dazu, dass das Modell ältere Inhalte abschneidet.
Warum haben verschiedene Modelle unterschiedliche Token-Zahlen für denselben Text?
Jedes Modell verwendet seinen eigenen Tokenisierer (BPE-Token-Vokabular). OpenAI-Modelle verwenden tiktoken; Claude den internen Tokenisierer von Anthropic; Gemini SentencePiece. Die Unterschiede sind für englischen Text typischerweise gering (5–15%), können aber für andere Sprachen größer sein.
Wird mein Text an einen Server gesendet?
Nein. Die gesamte Zählung erfolgt in deinem Browser mit JavaScript. Dein Text verlässt nie dein Gerät.
Kann ich dieses Tool mit vorausgefüllten Eingaben teilen?
Ja. Die URL aktualisiert sich während du tippst. Kopiere den Link aus der Adressleiste oder klicke auf Teilen — wer den Link öffnet, sieht deine Eingaben bereits ausgefüllt.
Ähnliche Werkzeuge
KI-Text-Teiler — RAG und Embeddings
Text in Chunks für RAG-Pipelines und LLM-Embeddings aufteilen. Chunk-Größe nach Tokens oder Zeichen mit optionaler Überlappung festlegen. Kostenloser KI-Text-Teiler online.
Atbash-Chiffre-Encoder und -Decoder
Kodiere und dekodiere die Atbash-Chiffre online. Atbash spiegelt das Alphabet und ist sein eigenes Inverses, ein Klick verschlüsselt und entschlüsselt. Kostenlos und privat.
Hintergrund entfernen
Entferne den Hintergrund jedes Bildes online und lade ein transparentes PNG herunter. Läuft per KI im Browser, dein Foto wird nie hochgeladen.