Aller au contenu
Français

Compteur de tokens

Compteur de tokens gratuit pour GPT, Claude et Gemini. Collez n’importe quel texte pour voir approximativement combien de tokens il coûte, avec les caractères, les mots et les caractères par token. Les comptages sont estimés dans votre navigateur : rien de ce que vous collez n’est envoyé.

Tokens GPT
estimation
Tokens Claude
estimation
Tokens Gemini
estimation
Caractères
Mots
Caractères / token

Calculé localement avec un modèle de caractères — généralement à ±10% près pour la prose anglaise, ±15% pour le code et le JSON, et ±20% pour le chinois, le japonais et le coréen. Rien de ce que vous collez ne quitte votre navigateur.

Coût d’entrée
à $5.00/1M en entrée · tarifs du 2026-08-08
Contexte utilisé
sur une fenêtre de 1,000,000 tokens

Comment utiliser compteur de tokens

  1. 01
    Collez votre texte

    Ajoutez un prompt, un document, un fichier de code ou une conversation. Le comptage se met à jour à la frappe.

  2. 02
    Lisez les trois comptages

    GPT, Claude et Gemini découpent le texte différemment : le même contenu coûte un nombre de tokens différent sur chacun.

  3. 03
    Regardez les caractères par token

    La prose anglaise avoisine 4. Le code et le JSON descendent plus bas car la ponctuation devient des tokens à part.

  4. 04
    Choisissez un modèle

    Le modèle sélectionné détermine le pourcentage de fenêtre de contexte et le coût d’entrée indicatif affiché en dessous.

  5. 05
    Vérifiez avant de budgétiser

    Pour un chiffre qui engage la facturation, confirmez-le avec le compteur officiel du fournisseur : les liens sont sous les résultats.

Exemples

Un brouillon d’article de 500 mots
≈ 600 tokens · 4,6 caractères/token
La prose anglaise simple est le meilleur cas pour l’estimation.
Un fichier TypeScript de 40 lignes
≈ 610 tokens · 3,0 caractères/token
La ponctuation et l’indentation rendent le code bien plus dense que la prose.
Un paragraphe chinois de 200 caractères
≈ 140 tokens · 1,4 caractère/token
Le CJK concentre bien plus de tokens par caractère que l’alphabet latin.

Formule

Le texte est découpé en séquences et chaque séquence est comptée séparément : un mot d’au plus cinq lettres coûte un token et en ajoute un tous les trois caractères supplémentaires, les chiffres se regroupent par trois, les suites de ponctuation fusionnent par deux et le CJK coûte environ 0,7 token par caractère. Le total est ensuite ajusté par un ratio propre à chaque fournisseur. Deux règles empiriques donnent le même ordre de grandeur pour la prose anglaise : environ 4 caractères par token, ou environ 1,33 token par mot.

tokens ≈ Σ(coût de séquence) × ratio du fournisseur

Foire aux questions

Quelle est la précision de ce compteur de tokens ?

C’est une estimation, pas un comptage exact. Sur de la prose anglaise, l’écart reste généralement sous 10 %, sous 15 % pour le code et le JSON, et sous 20 % pour le chinois, le japonais et le coréen. C’est suffisant pour dimensionner un prompt ou vérifier une facture, mais si le chiffre engage la facturation, confirmez-le avec le compteur du fournisseur.

Combien de tokens fait un mot ?

Pour la prose anglaise, environ 1,33 token par mot, soit à peu près 4 caractères par token. Les mots courts et fréquents tiennent en un seul token, tandis que les mots longs ou rares se découpent en plusieurs morceaux. La ponctuation, les retours à la ligne et l’indentation coûtent aussi des tokens, ce qui explique pourquoi le code et le JSON sont bien plus denses que du texte ordinaire.

Pourquoi GPT, Claude et Gemini affichent-ils des comptages différents ?

Chaque fournisseur entraîne son propre tokenizer sur un vocabulaire différent, donc la même phrase se découpe autrement sur chacun. L’écart tourne généralement autour de 10 %, mais il se creuse sur le code, les textes non anglais et les mises en forme inhabituelles. Les fournisseurs changent aussi de tokenizer entre générations de modèles, si bien que les comptages évoluent lors d’une mise à niveau.

Le texte que je colle est-il envoyé quelque part ?

Non. Tout le calcul se fait dans votre navigateur avec un modèle de caractères local, et rien n’est transmis à un serveur ni à un fournisseur de modèles. C’est d’ailleurs pourquoi le comptage est une estimation et non une valeur exacte : un comptage exact supposerait d’embarquer un vocabulaire de tokenizer volumineux ou d’appeler l’API d’un fournisseur avec votre texte.

Pourquoi le coût ignore-t-il la réponse du modèle ?

Le texte collé ne décrit que l’entrée. La longueur de la sortie dépend de ce que vous demandez et de la façon dont le modèle répond, et les tokens de sortie coûtent généralement plusieurs fois plus cher que ceux d’entrée. Plutôt que d’inventer une longueur de réponse, l’outil n’affiche que le coût d’entrée. Considérez tous les prix comme indicatifs : les tarifs changent souvent.

Dernière mise à jour . Conçu par Tooligan.