Contador de Tokens de IA — GPT, Claude e Gemini
≈ estimativa · compatível com GPT-4 / Claude / Gemini
O que é Contador de Tokens de IA — GPT, Claude e Gemini
Um contador de tokens estima quantos tokens um texto usa quando processado por grandes modelos de linguagem (LLMs) como GPT-4, Claude ou Gemini. Tokens são a unidade fundamental que modelos de IA usam para ler texto — aproximadamente 1 token a cada 4 caracteres, ou cerca de 0,75 tokens por palavra em inglês. Saber a contagem de tokens é essencial ao escrever prompts, construir pipelines RAG ou manter-se dentro dos limites da janela de contexto para evitar truncamento e controlar custos de API.
Como usar
- Cole ou digite qualquer texto no campo de entrada — prompts, documentos, código ou histórico de conversa.
- Leia a contagem de tokens instantaneamente no cartão azul no topo.
- Verifique as barras de uso de contexto para ver que porcentagem das janelas de contexto do GPT-4 (128k) e Claude (200k) seu texto ocupa.
- Use as contagens de caracteres e palavras como referência adicional.
Quando usar
Está montando um chatbot RAG e receia que o chunk recuperado mais o prompt do sistema não caibam na janela de 128k do GPT-4? Cole o texto combinado e você vê que ele usa 4.200 tokens (3,3% do limite), com espaço de sobra para a resposta do modelo antes de chamar a API. Útil para enxugar prompts, dimensionar chunks e estimar o custo por chamada.
Perguntas frequentes
Qual é a precisão deste contador de tokens?
Esta ferramenta usa uma heurística compatível com BPE (aproximadamente 4 caracteres por token para inglês) e tem precisão de ±10% para texto em inglês típico. Para contagens exatas, use a biblioteca tiktoken oficial da OpenAI. Scripts não-latinos, código e texto com muita pontuação podem variar mais.
O que é um token em modelos de IA?
Um token é um pedaço de texto que um modelo de IA processa como unidade. Pode ser uma palavra inteira, parte de uma palavra ou um único caractere. Palavras comuns como 'the' são um token; palavras mais longas podem ser divididas em múltiplos tokens. A maioria dos LLMs cobra o uso de API por tokens consumidos.
O que é uma janela de contexto?
Uma janela de contexto é o número máximo de tokens que um modelo pode processar em uma única requisição — incluindo seu prompt, histórico de conversa, documentos recuperados e a resposta do modelo. O GPT-4 Turbo suporta 128k tokens; o Claude 3 suporta até 200k. Exceder esse limite faz o modelo truncar conteúdo mais antigo.
Por que modelos diferentes têm contagens de tokens diferentes para o mesmo texto?
Cada modelo usa seu próprio tokenizador (vocabulário de tokens BPE). Modelos OpenAI usam tiktoken; Claude usa o tokenizador interno da Anthropic; Gemini usa SentencePiece. As diferenças são tipicamente pequenas (5–15%) para texto em inglês, mas podem ser maiores em outros idiomas.
Meu texto é enviado para um servidor?
Não. Toda a contagem acontece no seu navegador com JavaScript. Seu texto nunca sai do seu dispositivo.
Posso compartilhar esta ferramenta com meus dados preenchidos?
Sim. A URL é atualizada automaticamente enquanto você digita. Copie da barra de endereço ou use o botão Compartilhar — quem abrir verá seus dados exatos já preenchidos.
Ferramentas relacionadas
Divisor de Texto para IA — RAG e Embeddings
Divida texto em chunks para pipelines RAG e embeddings de LLM. Defina o tamanho por tokens ou caracteres com sobreposição opcional. Divisor de texto IA gratuito online.
Codificador e Decodificador da Cifra Atbash
Codifique e decodifique a cifra Atbash online. O Atbash espelha o alfabeto e é seu próprio inverso, então um clique embaralha e desembaralha. Grátis e privado.
Removedor de Fundo
Remova o fundo de qualquer imagem online e baixe um PNG transparente. Roda no seu navegador com IA, sua foto nunca é enviada. Grátis.