Contador de tokens
Contador de tokens grátis para GPT, Claude e Gemini. Cole qualquer texto para ver aproximadamente quantos tokens ele custa, junto com caracteres, palavras e caracteres por token. As contagens são estimadas no seu navegador — nada do que você colar é enviado.
Como usar contador de tokens
- 01Cole seu texto
Coloque um prompt, documento, arquivo de código ou transcrição de conversa. A contagem atualiza enquanto você digita.
- 02Leia as três contagens
GPT, Claude e Gemini tokenizam de formas diferentes, então o mesmo texto custa um número diferente de tokens em cada um.
- 03Confira caracteres por token
A prosa em inglês fica perto de 4. Código e JSON caem abaixo disso porque a pontuação vira tokens próprios.
- 04Escolha um modelo
O modelo selecionado define a porcentagem da janela de contexto e o custo de entrada indicativo abaixo dela.
- 05Verifique antes de orçar
Para números que afetam a cobrança, confirme no contador oficial do provedor — os links ficam abaixo dos resultados.
Exemplos
Fórmula
O texto é dividido em trechos e cada trecho é medido separadamente: uma palavra de até cinco letras custa um token e ganha mais um a cada três letras adicionais, dígitos se agrupam de três em três, trechos de pontuação se juntam de dois em dois e o CJK custa cerca de 0,7 token por caractere. Depois o total é ajustado por uma proporção de cada provedor. Duas regras de bolso aproximam o mesmo resultado para prosa em inglês: cerca de 4 caracteres por token, ou cerca de 1,33 token por palavra.
tokens ≈ Σ(custo do trecho) × proporção do provedorPerguntas frequentes
Qual é a precisão deste contador de tokens?
É uma estimativa, não uma contagem exata. Em prosa em inglês costuma ficar dentro de 10% do número real, dentro de 15% em código e JSON e dentro de 20% em chinês, japonês e coreano. Isso basta para dimensionar um prompt ou conferir uma fatura, mas se o número afetar a cobrança, confirme no contador do próprio provedor.
Quantos tokens tem uma palavra?
Em prosa em inglês, cerca de 1,33 token por palavra, ou aproximadamente 4 caracteres por token. Palavras curtas e comuns costumam ser um único token, enquanto palavras longas ou incomuns se dividem em várias partes. Pontuação, quebras de linha e indentação também custam tokens, e é por isso que código e JSON são bem mais densos que texto comum.
Por que GPT, Claude e Gemini mostram contagens diferentes?
Cada provedor treina o próprio tokenizador com um vocabulário diferente, então a mesma frase se divide de outro jeito em cada um. A diferença costuma ficar em torno de 10%, mas aumenta com código, textos fora do inglês e formatação incomum. Os provedores também trocam de tokenizador entre gerações de modelos, então as contagens podem mudar quando você atualiza.
O texto que eu colo é enviado para algum lugar?
Não. Todo o cálculo roda no seu navegador com um modelo local de caracteres, e nada é enviado a um servidor ou a qualquer provedor de modelos. É também por isso que a contagem é uma estimativa e não um valor exato: uma contagem exata exigiria embarcar um vocabulário de tokenizador enorme ou chamar a API de um provedor com o seu texto.
Por que o custo ignora a resposta do modelo?
O texto colado só descreve a entrada. O tamanho da saída depende do que você pede e de como o modelo responde, e tokens de saída costumam custar várias vezes mais que os de entrada. Em vez de inventar um tamanho de resposta, a ferramenta mostra apenas o custo de entrada. Trate todos os preços como indicativos — as tarifas mudam com frequência.
Última atualização . Feito por Tooligan.