टोकन काउंटर
GPT, Claude और Gemini के लिए मुफ्त टोकन काउंटर। कोई भी टेक्स्ट पेस्ट करें और देखें कि उसमें लगभग कितने टोकन लगते हैं, साथ ही वर्ण, शब्द और प्रति टोकन वर्ण। गणना आपके ब्राउज़र में होती है — आपका पेस्ट किया गया टेक्स्ट कहीं अपलोड नहीं होता।
टोकन काउंटर का उपयोग कैसे करें
- 01अपना टेक्स्ट पेस्ट करें
प्रॉम्प्ट, दस्तावेज़, कोड फ़ाइल या चैट ट्रांसक्रिप्ट डालें। टाइप करते ही गिनती अपडेट होती रहती है।
- 02तीनों गिनतियाँ पढ़ें
GPT, Claude और Gemini टेक्स्ट को अलग-अलग तरीके से बाँटते हैं, इसलिए एक ही टेक्स्ट पर तीनों की टोकन संख्या अलग होती है।
- 03प्रति टोकन वर्ण देखें
अंग्रेज़ी गद्य में यह लगभग 4 रहता है। कोड और JSON में यह घट जाता है क्योंकि विराम चिह्न अलग टोकन बन जाते हैं।
- 04मॉडल चुनें
आपके चुने मॉडल से ही कॉन्टेक्स्ट विंडो का प्रतिशत और नीचे दिखने वाली अनुमानित इनपुट लागत तय होती है।
- 05बजट बनाने से पहले जाँचें
बिलिंग से जुड़े आँकड़ों के लिए प्रदाता के आधिकारिक काउंटर से पुष्टि करें — लिंक परिणामों के नीचे दिए गए हैं।
उदाहरण
सूत्र
टेक्स्ट को हिस्सों में बाँटकर हर हिस्से की अलग गणना होती है: पाँच अक्षरों तक का शब्द एक टोकन का होता है और उसके बाद हर तीन अक्षरों पर एक टोकन जुड़ता है, अंक तीन-तीन के समूह में गिने जाते हैं, लगातार आने वाले विराम चिह्न दो-दो में मिलते हैं, और CJK में प्रति वर्ण लगभग 0.7 टोकन लगते हैं। फिर कुल योग को प्रदाता के अनुपात से गुणा किया जाता है। अंग्रेज़ी गद्य के लिए दो सामान्य नियम लगभग यही परिणाम देते हैं: प्रति टोकन लगभग 4 वर्ण, या प्रति शब्द लगभग 1.33 टोकन।
टोकन ≈ Σ(हिस्से की लागत) × प्रदाता अनुपातअक्सर पूछे जाने वाले प्रश्न
यह टोकन काउंटर कितना सटीक है?
यह अनुमान है, सटीक गिनती नहीं। अंग्रेज़ी गद्य में यह आम तौर पर वास्तविक संख्या के 10% के भीतर रहता है, कोड और JSON में 15% के भीतर, तथा चीनी, जापानी और कोरियाई में 20% के भीतर। प्रॉम्प्ट का आकार तय करने या बिल जाँचने के लिए यह पर्याप्त है, पर अगर आँकड़ा बिलिंग से जुड़ा हो तो प्रदाता के अपने काउंटर से पुष्टि करें।
एक शब्द में कितने टोकन होते हैं?
अंग्रेज़ी गद्य में लगभग 1.33 टोकन प्रति शब्द, यानी करीब 4 वर्ण प्रति टोकन। छोटे और आम शब्द आमतौर पर एक ही टोकन होते हैं, जबकि लंबे या असामान्य शब्द कई हिस्सों में बँट जाते हैं। विराम चिह्न, लाइन ब्रेक और इंडेंटेशन भी टोकन लेते हैं, इसीलिए कोड और JSON सामान्य लेखन से कहीं अधिक सघन होते हैं।
GPT, Claude और Gemini की गिनती अलग क्यों होती है?
हर प्रदाता अपना टोकनाइज़र अलग शब्दावली पर प्रशिक्षित करता है, इसलिए एक ही वाक्य हर जगह अलग तरह से बँटता है। अंतर आम तौर पर करीब 10% रहता है, पर कोड, गैर-अंग्रेज़ी टेक्स्ट और असामान्य फ़ॉर्मैटिंग में यह बढ़ जाता है। प्रदाता मॉडल की पीढ़ियों के बीच टोकनाइज़र भी बदलते हैं, इसलिए अपग्रेड करने पर गिनती बदल सकती है।
क्या मेरा पेस्ट किया गया टेक्स्ट अपलोड होता है?
नहीं। पूरी गणना आपके ब्राउज़र में एक स्थानीय वर्ण-आधारित मॉडल से होती है और कुछ भी किसी सर्वर या मॉडल प्रदाता को नहीं भेजा जाता। यही वजह है कि गिनती सटीक न होकर अनुमान है: सटीक गिनती के लिए या तो बहुत बड़ी टोकनाइज़र शब्दावली भेजनी पड़ती या आपके टेक्स्ट के साथ प्रदाता की API कॉल करनी पड़ती।
लागत में मॉडल का उत्तर क्यों शामिल नहीं है?
पेस्ट किया गया टेक्स्ट केवल इनपुट की जानकारी देता है। आउटपुट की लंबाई इस पर निर्भर करती है कि आप क्या माँगते हैं और मॉडल कैसे उत्तर देता है, और आउटपुट टोकन आम तौर पर इनपुट टोकन से कई गुना महँगे होते हैं। उत्तर की लंबाई मान लेने के बजाय यह टूल केवल इनपुट लागत दिखाता है। यहाँ दी गई हर कीमत को अनुमानित मानें — दरें अक्सर बदलती रहती हैं।
अंतिम अपडेट . द्वारा बनाया गया Tooligan.