Token 计数器
面向 GPT、Claude 和 Gemini 的免费 token 计数器。粘贴任意文本,即可看到它大约需要多少 token,以及字符数、词数和每个 token 对应的字符数。计算在浏览器中完成,你粘贴的内容不会被上传。
如何使用token 计数器
- 01粘贴文本
放入提示词、文档、代码文件或聊天记录,数值会随输入实时更新。
- 02查看三组 token 数
GPT、Claude 和 Gemini 的切分方式不同,同一段文本在各家的 token 数也不一样。
- 03关注每 token 字符数
英文散文大约是 4。代码和 JSON 会更低,因为标点会单独占用 token。
- 04选择模型
所选模型决定了上下文窗口占用百分比,以及下方作为参考的输入成本。
- 05做预算前先核对
涉及计费的数字,请用结果下方链接到的官方计数器再确认一次。
示例
公式
文本会被切成若干片段并分别计价:不超过五个字母的单词算一个 token,之后每多三个字母增加一个;数字按三位一组计算;连续标点每两个合并为一个;中日韩文字约为每字符 0.7 个 token。总数再乘以各家提供方的比例系数。对英文散文来说,两条经验法则给出的结果基本一致:每个 token 约 4 个字符,或每个词约 1.33 个 token。
token ≈ Σ(片段开销) × 提供方比例常见问题
这个 token 计数器有多准?
它给出的是估算值,不是精确计数。英文散文通常与真实数值相差 10% 以内,代码和 JSON 在 15% 以内,中文、日文和韩文在 20% 以内。用来判断提示词规模或核对账单已经足够;但如果这个数字直接关系到计费,请用提供方自己的计数器确认。
一个词等于多少 token?
对英文散文而言,大约每词 1.33 个 token,或每个 token 约 4 个字符。短的常用词通常是一个 token,较长或少见的词会被拆成好几块。标点、换行和缩进同样消耗 token,这也是代码和 JSON 比普通文字密集得多的原因。
为什么 GPT、Claude 和 Gemini 的结果不一样?
每家提供方都用不同的词表训练自己的分词器,因此同一句话在各家的切分方式不同。差距通常在 10% 左右,但在代码、非英文文本和特殊排版上会更大。提供方还会在模型换代时更换分词器,所以升级之后数值也可能发生变化。
我粘贴的文本会被上传吗?
不会。全部计算都在你的浏览器中通过本地字符模型完成,不会发送到任何服务器或模型提供方。这也正是结果只能是估算值的原因:要做到精确计数,要么需要加载体积庞大的分词词表,要么需要带着你的文本调用提供方的 API。
为什么成本不包含模型的回复?
粘贴的文本只能说明输入部分。输出长度取决于你提出的要求以及模型如何作答,而输出 token 的单价通常是输入的数倍。与其臆测一个回复长度,这个工具只显示输入成本。这里的所有价格都请当作参考——费率经常变动。
最后更新 . 构建者 Tooligan.