Contador de tokens
Contador de tokens gratis para GPT, Claude y Gemini. Pega cualquier texto para ver aproximadamente cuántos tokens cuesta, junto con caracteres, palabras y caracteres por token. Los recuentos se estiman en tu navegador: nada de lo que pegues se sube.
Cómo usar contador de tokens
- 01Pega tu texto
Añade un prompt, un documento, un archivo de código o una conversación. El recuento se actualiza mientras escribes.
- 02Lee los tres recuentos
GPT, Claude y Gemini tokenizan de forma distinta, así que el mismo texto cuesta un número diferente de tokens en cada uno.
- 03Mira los caracteres por token
La prosa en inglés ronda 4. El código y el JSON bajan porque la puntuación se divide en tokens propios.
- 04Elige un modelo
El modelo que selecciones determina el porcentaje de ventana de contexto y el coste de entrada orientativo.
- 05Verifica antes de presupuestar
Para cifras que afecten a la facturación, confírmalas con el contador oficial del proveedor: los enlaces están bajo los resultados.
Ejemplos
Fórmula
El texto se divide en tramos y cada tramo se valora por separado: una palabra de hasta cinco letras cuesta un token y suma otro cada tres letras adicionales, los dígitos se agrupan de tres en tres, los tramos de puntuación se fusionan de dos en dos y el CJK cuesta unos 0,7 tokens por carácter. Después el total se escala con una proporción por proveedor. Dos reglas prácticas aproximan lo mismo para la prosa en inglés: unos 4 caracteres por token, o unos 1,33 tokens por palabra.
tokens ≈ Σ(coste del tramo) × proporción del proveedorPreguntas frecuentes
¿Qué precisión tiene este contador de tokens?
Es una estimación, no un recuento exacto. En prosa en inglés suele quedar dentro de un 10% del número real, dentro de un 15% en código y JSON, y dentro de un 20% en chino, japonés y coreano. Es suficiente para dimensionar un prompt o revisar una factura, pero si la cifra afecta a la facturación, confírmala con el contador del proveedor.
¿Cuántos tokens es una palabra?
En prosa en inglés, alrededor de 1,33 tokens por palabra, o unos 4 caracteres por token. Las palabras cortas y frecuentes suelen ser un solo token, mientras que las largas o poco habituales se dividen en varias piezas. La puntuación, los saltos de línea y la indentación también cuestan tokens, por eso el código y el JSON son mucho más densos que la escritura normal.
¿Por qué GPT, Claude y Gemini muestran recuentos distintos?
Cada proveedor entrena su propio tokenizador con un vocabulario diferente, así que la misma frase se divide de otra manera en cada uno. La diferencia suele estar en torno al 10%, pero crece con el código, el texto que no está en inglés y los formatos poco habituales. Además, los proveedores cambian de tokenizador entre generaciones de modelos, así que los recuentos pueden variar al actualizar.
¿Se sube el texto que pego?
No. Todo el cálculo se ejecuta en tu navegador con un modelo local de caracteres y no se envía nada a ningún servidor ni proveedor de modelos. Por eso mismo el recuento es una estimación y no un valor exacto: un recuento exacto exigiría incluir un vocabulario de tokenizador enorme o llamar a la API de un proveedor con tu texto.
¿Por qué el coste no incluye la respuesta del modelo?
El texto que pegas solo describe la entrada. La longitud de la salida depende de lo que pidas y de cómo responda el modelo, y los tokens de salida suelen costar varias veces más que los de entrada. En lugar de inventar una longitud de respuesta, la herramienta muestra solo el coste de entrada. Considera todos los precios como orientativos: las tarifas cambian a menudo.
Última actualización . Creado por Tooligan.