अक्षर और शब्द गणक
अपने टेक्स्ट में अक्षरों, शब्दों और अधिक की गणना करें
अक्षर और शब्द गणक का उपयोग कैसे करें
- 1
अपना टेक्स्ट दर्ज करें
जिस टेक्स्ट का आप विश्लेषण करना चाहते हैं उसे टेक्स्ट बॉक्स में टाइप करें या पेस्ट करें, और जैसे-जैसे आप लिखते हैं गिनती तुरंत अपडेट होती जाती है।
- 2
आँकड़े पढ़ें
अक्षरों, शब्दों, लाइनों, वाक्यों और पैराग्राफ़ों के लाइव योग देखें, साथ ही अनुमानित पढ़ने और बोलने का समय भी।
- 3
गति समायोजित करें
अपनी खुद की पढ़ने और बोलने की words-per-minute सेट करने के लिए सेटिंग खोलें, या गहन विश्लेषण के लिए फ़्रीक्वेंसी टेबल चालू करें।
- 4
नतीजों का इस्तेमाल करें
अपना टेक्स्ट कॉपी करें या आँकड़े नोट करें, उदाहरण के लिए किसी पोस्ट या मेटा विवरण की अक्षर सीमा के भीतर रहने के लिए।
वर्ण गिनना: सीमाएँ, Unicode, और असली उपयोग के मामले
स्पेस सहित और स्पेस रहित वर्ण
हर वर्ण-गणक दो मुख्य संख्याएँ बताता है, और इन दोनों का फ़र्क लोगों को लगातार उलझाता है। 'कुल वर्ण' आपके द्वारा टाइप की गई हर चीज़ गिनता है, जिसमें स्पेस, टैब, विराम-चिह्न और लाइन ब्रेक शामिल हैं। 'स्पेस रहित वर्ण' व्हाइटस्पेस हटा देता है और केवल दृश्य चिह्न गिनता है। 'I am here' वाक्यांश कुल नौ वर्ण है पर स्पेस रहित सात।
आपको कौन-सी संख्या चाहिए, यह पूरी तरह इस पर निर्भर करता है कि पाठ कहाँ जा रहा है। सोशल प्लेटफ़ॉर्म और SMS लगभग हमेशा स्पेस गिनते हैं, इसलिए वहाँ कुल ही मायने रखता है। कुछ शैली-निर्देशिकाएँ, टाइपसेटर, और शैक्षणिक 'स्पेस-रहित' वर्ण-सीमाएँ छोटे आँकड़े का उपयोग करती हैं। यह टूल दोनों एक साथ दिखाता है, साथ ही अक्षरों, अंकों, स्पेस, विराम-चिह्न और विशेष वर्णों का विवरण भी, ताकि आप जो भी कोई दिया गया प्लेटफ़ॉर्म असल में मापता है उससे मेल बैठा सकें।
वर्ण-सीमाएँ असल में कहाँ चुभती हैं
असली तंत्र सख्त वर्ण-सीमाएँ लागू करते हैं, और सटीक संख्याएँ जानना आपको कटे-फटे पाठ से बचाता है। एक अकेला SMS खंड मानक GSM वर्णमाला का उपयोग करते हुए 160 वर्ण का होता है; एक भी ऊपर जाइए और संदेश या तो कई बिल किए जाने वाले हिस्सों में बँट जाता है या, अगर इसमें कुछ खास Unicode हो, तो प्रति खंड 70-वर्ण की सीमा पर गिर जाता है। X (पहले Twitter) पर एक क्लासिक पोस्ट 280 वर्ण की अनुमति देती है।
सूची आगे बढ़ती है। सर्च इंजन मेटा डिस्क्रिप्शन परिणामों में कटने से पहले प्रभावी रूप से लगभग 155 से 160 वर्ण पर सीमित होते हैं, एक SEO पेज शीर्षक लगभग 60 पर। Instagram कैप्शन 2,200 वर्ण तक की अनुमति देते हैं, लेकिन 'more' से पहले केवल पहले ~125 ही दिखते हैं। प्रोफ़ाइल बायो भी कसे होते हैं: X बायो 160 वर्ण के होते हैं, और कई प्लेटफ़ॉर्म डिस्प्ले नाम और हेडलाइन को 100 से काफ़ी नीचे सीमित करते हैं। प्रकाशित करने से पहले गिनना आपके संदेश को सही-सलामत रखता है।
Unicode और इमोजी कैसे गिने जाते हैं
भीतर ही भीतर हर वर्ण एक इकाई नहीं होता, और यहीं टूलों के बीच गिनती अलग हो जाती है। JavaScript, जो आपके ब्राउज़र में चलता है, स्ट्रिंग को UTF-16 कोड इकाइयों में मापता है। सामान्य अक्षर और अंक प्रत्येक एक इकाई होते हैं, लेकिन बुनियादी सीमा से परे के वर्ण, जिनमें अधिकांश इमोजी शामिल हैं, दो इकाइयों के रूप में संग्रहीत होते हैं, जिन्हें सरोगेट जोड़ी कहते हैं। तो एक अकेली मुस्कुराते-चेहरे वाली इमोजी दो की लंबाई के रूप में दर्ज हो सकती है।
संयुक्त इमोजी के साथ यह और सूक्ष्म हो जाता है। एक परिवार वाली इमोजी या एक झंडा कई कोड बिंदुओं को आपस में जोड़कर बनाया जाता है, इसलिए एक चित्र जिसे आप एक अकेली तस्वीर के रूप में देखते हैं, वह चार, सात, या उससे अधिक इकाइयाँ गिना जा सकता है। त्वचा-रंग संशोधक और भिन्नता चयनकर्ता भी कुल में जुड़ते हैं। अगर कोई प्लेटफ़ॉर्म ऐसे कैप्शन को अस्वीकार कर दे जिसे आप सीमा के भीतर समझ रहे थे, तो अक्सर भटकी हुई इमोजी ही वह वजह होती हैं कि भीतरी गिनती दृश्य वर्णों के सुझाव से अधिक होती है।
यह टूल जो पूरा विवरण देता है
दोनों वर्ण-कुलों के अलावा, यह गणक आपके पाठ को विस्तार से वर्गीकृत करता है: अक्षर, अंक, स्पेस, विराम-चिह्न, और विशेष वर्ण, साथ ही अलग-अलग बड़े और छोटे अक्षरों की गिनती और एक पंक्ति-गणना भी। यह बारीकी उन कामों के लिए उपयोगी है जिनका जवाब कोई एक अकेला कुल नहीं दे सकता, जैसे यह जाँचना कि किसी पासवर्ड नमूने में पर्याप्त अंक और चिह्न हैं, या यह पुष्टि करना कि किसी कोड स्निपेट में कोई भटका हुआ बड़ा अक्षर नहीं है।
यह शब्द, वाक्य, पैराग्राफ, औसत शब्द-लंबाई, और औसत वाक्य-लंबाई भी बताता है, और पढ़ने तथा बोलने का समय दोनों का अनुमान लगाता है। पढ़ने और बोलने की गति सेटिंग्स में समायोज्य है, इसलिए आप अपनी रफ़्तार या किसी विशिष्ट श्रोता-वर्ग से मेल बैठा सकते हैं। वैकल्पिक फ़्रीक्वेंसी तालिकाएँ यह उजागर करती हैं कि हर वर्ण और शब्द कितनी बार आता है, जो एक झटपट कीवर्ड-घनत्व जाँच का भी काम करती हैं।
प्लेटफ़ॉर्म के हिसाब से उपयोग के मामले
सोशल मीडिया प्रबंधक इन्हीं संख्याओं के सहारे जीते हैं। एक ट्वीट, एक विज्ञापन हेडलाइन, या एक पुश नोटिफ़िकेशन लिखने का मतलब है एक सटीक सीमा तक लिखना, और एक लाइव गणक आपको सीमा पार करते ही एक शब्द छाँटने या एक वाक्यांश बदलने देता है, बजाय इसके कि पोस्ट अस्वीकार होने के बाद पता चले। यही YouTube शीर्षकों पर लागू होता है, जो कई जगह केवल लगभग 70 वर्ण दिखाते हैं।
SEO और मार्केटिंग का काम भी उतना ही गिनती-संचालित है। आप एक ऐसा मेटा डिस्क्रिप्शन चाहते हैं जो ~155 वर्णों के भीतर कुछ पूरा कह दे ताकि वह सर्च परिणामों में वाक्य के बीच में न कटे, और एक शीर्षक ~60 से नीचे। डेवलपर और फ़ॉर्म डिज़ाइनर डेटाबेस फ़ील्ड आकार और API सीमाओं के भीतर रहने के लिए वर्ण-गणना का उपयोग करते हैं, और अनुवादक उन पर नज़र रखते हैं ताकि स्थानीयकृत पाठ निश्चित-चौड़ाई वाले बटन और लेबल से बाहर न छलके।
किसी सीमा के भीतर रहने के सुझाव
जब आपको वर्ण घटाने हों, तो पहले सबसे सस्ती कटौतियों को निशाना बनाइए। दोहरे स्पेस, पीछे लगे व्हाइटस्पेस, और अनावश्यक विराम-चिह्न हटाइए; वाक्यांशों को संकुचित कीजिए ('do not' को 'don't'); और छोटे पर्यायवाची पसंद कीजिए। URL महँगे होते हैं, इसलिए जब कोई प्लेटफ़ॉर्म लिंक को स्वतः छोटा न करे तब एक शॉर्टनर इस्तेमाल कीजिए, और याद रखिए कि कई नेटवर्क पर एक लिंक अपनी असली लंबाई की परवाह किए बिना एक निश्चित संख्या में वर्ण खपाता है।
जब आप किसी सीमा के क़रीब हों तो अपनी इमोजी और विशेष वर्णों पर नज़र रखिए, क्योंकि हर एक की लागत एक अकेली इकाई से अधिक हो सकती है। महत्वपूर्ण शब्दों को आगे रखिए ताकि अगर कोई कैप्शन 'more' लिंक के साथ कट जाए, तो दृश्य हिस्सा अपने-आप में समझ में आता रहे। हर संपादन के बाद, न कि केवल अंत में, गिनती जाँचना आपको अंतिम-क्षण की भागदौड़ से बचाता है।
टूलों के बीच गिनती क्यों अलग होती है
अगर दो गणक एक ही पाठ के बारे में असहमत हों, तो वजह लगभग हमेशा इन तीन में से एक होती है: वे पीछे लगे व्हाइटस्पेस और लाइन ब्रेक को कैसे संभालते हैं, वे बहु-बाइट वर्णों और इमोजी को कैसे गिनते हैं, और वे पाठ को पहले सामान्यीकृत करते हैं या नहीं। एक ऐसा टूल जो दृश्य ग्राफ़ीम क्लस्टर गिनता है, वह इमोजी-भरी स्ट्रिंग के लिए उससे कम वर्ण बताएगा जो अधिकांश प्लेटफ़ॉर्म की तरह कच्ची UTF-16 इकाइयाँ गिनता है।
अमूर्त रूप में कोई एक 'सही' गिनती नहीं होती; सही संख्या वही है जो आपका गंतव्य प्लेटफ़ॉर्म उपयोग करता है। चूँकि यह टूल वैसे ही गिनता है जैसे ब्राउज़र और अधिकांश वेब प्लेटफ़ॉर्म गिनते हैं, इसका कुल पोस्ट, बायो और फ़ॉर्म फ़ील्ड के लिए एक भरोसेमंद मार्गदर्शक है। जब कोई सख्त तंत्र फिर भी असहमत हो, तो किसी छिपे हुए वर्ण पर शक कीजिए, जैसे शून्य-चौड़ाई वाले स्पेस या किसी दूसरे ऐप से पेस्ट किए गए नॉन-ब्रेकिंग स्पेस।
आम ग़लतियाँ
सबसे बड़ी ग़लती काम के लिए ग़लत मीट्रिक गिनना है: स्पेस गिनने वाले प्लेटफ़ॉर्म के लिए 'स्पेस रहित वर्ण' का उपयोग करना, या इसका उल्टा, और फिर असली सीमा को पार कर जाना। उस पर भरोसा करने से पहले हमेशा पुष्टि कीजिए कि आपका लक्ष्य कौन-सा आँकड़ा उपयोग करता है, और सोशल पोस्ट और SMS के लिए स्पेस-सहित कुल वाली संख्या पर टिके रहिए, जहाँ स्पेस लगभग हमेशा गिने जाते हैं।
दूसरी ग़लती अदृश्य वर्णों को भूल जाना है। किसी वर्ड प्रोसेसर से पेस्ट करने पर नॉन-ब्रेकिंग स्पेस, स्मार्ट कोट्स जो एक ही वर्ण घेरते हैं पर अलग दिखते हैं, या इमोजी के भीतर शून्य-चौड़ाई वाले जॉइनर चुपके से आ सकते हैं। ये गिनती फुला देते हैं और कभी-कभी प्लेटफ़ॉर्म सत्यापन तोड़ देते हैं। जब कोई संख्या होने से अधिक दिखे, तो संदिग्ध हिस्से को सादे पाठ के रूप में फिर से टाइप कीजिए और गिनती को वापस ठीक होते देखिए।
अक्सर पूछे जाने वाले प्रश्न
यह काउंटर असल में क्या मापता है?
पढ़ने और बोलने का समय कैसे निकाला जाता है?
क्या यह स्पेस और विराम चिह्नों को अक्षर के रूप में गिनता है?
फ़्रीक्वेंसी टेबल किसलिए हैं?
क्या यह रियल टाइम में काम करता है और निजी रहता है?
संबंधित टूल्स
इन उपयोगी टूल्स के साथ आगे बढ़ें