Compteur de tokens
Compteur de tokens gratuit pour GPT, Claude et Gemini. Collez n’importe quel texte pour voir approximativement combien de tokens il coûte, avec les caractères, les mots et les caractères par token. Les comptages sont estimés dans votre navigateur : rien de ce que vous collez n’est envoyé.
Comment utiliser compteur de tokens
- 01Collez votre texte
Ajoutez un prompt, un document, un fichier de code ou une conversation. Le comptage se met à jour à la frappe.
- 02Lisez les trois comptages
GPT, Claude et Gemini découpent le texte différemment : le même contenu coûte un nombre de tokens différent sur chacun.
- 03Regardez les caractères par token
La prose anglaise avoisine 4. Le code et le JSON descendent plus bas car la ponctuation devient des tokens à part.
- 04Choisissez un modèle
Le modèle sélectionné détermine le pourcentage de fenêtre de contexte et le coût d’entrée indicatif affiché en dessous.
- 05Vérifiez avant de budgétiser
Pour un chiffre qui engage la facturation, confirmez-le avec le compteur officiel du fournisseur : les liens sont sous les résultats.
Exemples
Formule
Le texte est découpé en séquences et chaque séquence est comptée séparément : un mot d’au plus cinq lettres coûte un token et en ajoute un tous les trois caractères supplémentaires, les chiffres se regroupent par trois, les suites de ponctuation fusionnent par deux et le CJK coûte environ 0,7 token par caractère. Le total est ensuite ajusté par un ratio propre à chaque fournisseur. Deux règles empiriques donnent le même ordre de grandeur pour la prose anglaise : environ 4 caractères par token, ou environ 1,33 token par mot.
tokens ≈ Σ(coût de séquence) × ratio du fournisseurFoire aux questions
Quelle est la précision de ce compteur de tokens ?
C’est une estimation, pas un comptage exact. Sur de la prose anglaise, l’écart reste généralement sous 10 %, sous 15 % pour le code et le JSON, et sous 20 % pour le chinois, le japonais et le coréen. C’est suffisant pour dimensionner un prompt ou vérifier une facture, mais si le chiffre engage la facturation, confirmez-le avec le compteur du fournisseur.
Combien de tokens fait un mot ?
Pour la prose anglaise, environ 1,33 token par mot, soit à peu près 4 caractères par token. Les mots courts et fréquents tiennent en un seul token, tandis que les mots longs ou rares se découpent en plusieurs morceaux. La ponctuation, les retours à la ligne et l’indentation coûtent aussi des tokens, ce qui explique pourquoi le code et le JSON sont bien plus denses que du texte ordinaire.
Pourquoi GPT, Claude et Gemini affichent-ils des comptages différents ?
Chaque fournisseur entraîne son propre tokenizer sur un vocabulaire différent, donc la même phrase se découpe autrement sur chacun. L’écart tourne généralement autour de 10 %, mais il se creuse sur le code, les textes non anglais et les mises en forme inhabituelles. Les fournisseurs changent aussi de tokenizer entre générations de modèles, si bien que les comptages évoluent lors d’une mise à niveau.
Le texte que je colle est-il envoyé quelque part ?
Non. Tout le calcul se fait dans votre navigateur avec un modèle de caractères local, et rien n’est transmis à un serveur ni à un fournisseur de modèles. C’est d’ailleurs pourquoi le comptage est une estimation et non une valeur exacte : un comptage exact supposerait d’embarquer un vocabulaire de tokenizer volumineux ou d’appeler l’API d’un fournisseur avec votre texte.
Pourquoi le coût ignore-t-il la réponse du modèle ?
Le texte collé ne décrit que l’entrée. La longueur de la sortie dépend de ce que vous demandez et de la façon dont le modèle répond, et les tokens de sortie coûtent généralement plusieurs fois plus cher que ceux d’entrée. Plutôt que d’inventer une longueur de réponse, l’outil n’affiche que le coût d’entrée. Considérez tous les prix comme indicatifs : les tarifs changent souvent.
Dernière mise à jour . Conçu par Tooligan.