Metlivi ब्लॉग

कम मेहनत में लिखावट पहचान (Handwriting Recognition) की गलतियों की प्रूफरीडिंग कैसे करें

जब लिखावट पहचान (handwriting recognition) किसी शब्द को गलत पहचानती है, तो उन शब्दों से शुरुआत करें जिनके अर्थ बदलने की संभावना सबसे अधिक होती है: नाम, तिथियां, संख्याएं, नकारात्मक शब्द (negations) और अन्य महत्वपूर्ण विवरण जिन पर आपको कार्रवाई करनी है। हस्तलिखित नोट्स से उन स्थानों की तुलना करें, संदर्भ के अनुसार स्पष्ट गलतियों को ठीक करें, और फिर मूल कॉपी को दोबारा देखें ताकि कुछ ऐसा न छूट जाए जो केवल टेक्स्ट से समझ नहीं आ सकता। हर पहचाने गए शब्द को समान ध्यान से दोबारा पढ़ने की तुलना में यह लक्षित तरीका आमतौर पर अधिक कुशल होता है। यह गाइड उन लोगों के लिए है जो हस्तलिखित नोट्स या किसी हस्तलिखित पेज को संपादन योग्य (editable) टेक्स्ट में बदल रहे हैं। यह किसी ऐप को चुनने या किसी पहचान प्रणाली को प्रशिक्षित करने के बजाय, तैयार पहचान परिणाम की जांच करने पर केंद्रित है। इसका मुख्य विचार यह है कि जब भी कोई विवरण महत्वपूर्ण हो, तो पहचाने गए टेक्स्ट को एक ड्राफ्ट के रूप में और मूल लिखावट को प्रमाणिक स्रोत के रूप में उपयोग करें।

28 सितंबर 20266 मिनट का पठनरोज़मर्रा का सौंदर्य और आत्म-अभिव्यक्तिलेखक: Metlivi Editorial Team
खंड 1

महत्वपूर्ण विवरणों से शुरुआत करें

वाक्य में किसी छूटे हुए आर्टिकल जैसी टाइपो गलती का अंदाजा लगाना आसान हो सकता है। किसी तारीख में गलत अंक, नाम की गलत वर्तनी या छूटे हुए “नहीं” (not) को संदर्भ से पहचानना कहीं अधिक कठिन हो सकता है—और यह अधिक मायने भी रख सकता है। प्रूफरीडिंग शुरू करने से पहले उन विवरणों की एक त्वरित मानसिक सूची बना लें जिन्हें आपको सटीक रखना ही है:

यह प्राथमिकता क्रम एक व्यावहारिक संपादन पद्धति है, न कि यह दावा कि पहचान प्रणालियां हमेशा इसी प्रकार की गलतियां करती हैं। यहां से शुरुआत करने का कारण यह है कि किसी अनदेखी गलती का नुकसान इस बात पर निर्भर करता है कि टेक्स्ट का उपयोग किस उद्देश्य के लिए किया जाएगा। एक व्यक्तिगत ब्रेनस्टॉर्मिंग और मुलाकातों (appointments) की तारीखों की सूची को एक समान स्तर की जांच की आवश्यकता नहीं होती।

व्यक्तियों, स्थानों, परियोजनाओं या उत्पादों के नाम।
तिथियां, समय, मात्राएं, माप और क्रमांकित वस्तुएं।
नकारात्मक और प्रतिबंधात्मक शब्द जैसे “नहीं,” “केवल,” “पहले” और “बाद में।”
कोई भी निर्देश या निर्णय जिसे आप कॉपी करने, साझा करने या जिस पर कार्रवाई करने की योजना बना रहे हैं।
खंड 2

छवि और टेक्स्ट का एक साथ उपयोग करें

पहचाने गए टेक्स्ट को पढ़ते समय हस्तलिखित पेज को सामने खुला रखें। यदि संभव हो, तो छवि और टेक्स्ट को अगल-बगल रखें या किसी ऐसे व्यूअर का उपयोग करें जो आपको संबंधित क्षेत्र को ज़ूम करने की सुविधा देता हो। एक बार में एक वाक्य या छोटी पंक्ति की जांच करें: पहचाने गए शब्दों को पढ़ें, संबंधित हस्तलेखन को देखें, और जो कुछ भी स्पष्ट रूप से गलत है उसे ठीक करें।

टेक्स्ट को अलग से अकेले प्रूफरीड करने की तुलना में यह तरीका अधिक भरोसेमंद है क्योंकि मूल पेज उन अस्पष्टताओं को सुलझा सकता है जिन्हें व्याकरण हल नहीं कर सकता। इसके विपरीत, निकाला गया टेक्स्ट आपको एक घने पेज को आसानी से पढ़ने में मदद कर सकता है। Google का क्लाउड विज़न दस्तावेज़ बताता है कि उसका डॉक्यूमेंट टेक्स्ट डिटेक्शन टेक्स्ट को पेजों, ब्लॉकों, पैराग्राफों और शब्दों में व्यवस्थित करके देता है; Microsoft का OCR दस्तावेज़ पहचाने गए टेक्स्ट को शब्द-स्तरीय बाउंडिंग पॉलीगॉन और विश्वसनीयता (कॉन्फिडेंस) मानों के साथ दिखाता है। ये उन सूचनाओं के उदाहरण हैं जो कुछ OCR सेवाएं प्रदान करती हैं, न कि ऐसी सुविधाएं जो हर लिखावट ऐप में उपलब्ध हों ([Google Cloud Vision: लिखावट पहचान](https://cloud.google.com/vision/docs/handwriting); [Microsoft Learn: छवियों के लिए OCR](https://learn.microsoft.com/en-us/azure/ai-services/computer-vision/concept-ocr))।

**जब ऐप कॉन्फिडेंस स्कोर प्रदान करता है**

कम कॉन्फिडेंस स्कोर को संबंधित लिखावट की जांच करने के संकेत के रूप में लें, न कि इस निश्चित निर्णय के रूप में कि शब्द गलत ही है। Google का दस्तावेज़ीकरण अपने क्लाइंट उदाहरणों में सिंबल, शब्द, पैराग्राफ और पेज स्तरों पर कॉन्फिडेंस मान दिखाता है; Microsoft के उदाहरण प्रतिक्रिया में अलग-अलग शब्दों के लिए कॉन्फिडेंस मान शामिल हैं। ऐसे स्कोर एक लंबे पेज को "जल्दी जांचें" और "संभवतः सही" क्षेत्रों में छांटने में मदद कर सकते हैं, लेकिन वे आपको यह नहीं बताते कि कोई शब्द आपके अभीष्ट अर्थ के अनुसार सही है या नहीं। पूरे कॉन्फिडेंस के साथ पहचाना गया शब्द भी संदर्भ में गलत हो सकता है, और एक अस्पष्ट हस्तलिखित शब्द जांच के बाद भी संदिग्ध बना रह सकता है।

यदि आपका ऐप कॉन्फिडेंस स्कोर नहीं दिखाता है, तो आप यही विचार मैन्युअल रूप से लागू कर सकते हैं: पढ़ते समय अनिश्चित टेक्स्ट के आगे प्रश्न चिह्न लगाएं, फिर पहले राउंड के बाद उन स्थानों पर वापस आएं। हर कठिन अक्षर को सुलझाने के लिए बार-बार रुकने से बचें; अनिश्चित स्थानों को एक साथ समूह बनाकर जांचने से आसपास के शब्दों और पंक्तियों की एक साथ तुलना करना आसान हो जाता है।

खंड 3

एक त्वरित, दोहराने योग्य प्रूफरीडिंग प्रक्रिया

यह क्रम OCR दस्तावेज़ों में वर्णित संरचना और कॉन्फिडेंस जानकारी का एक संपादकीय रूपांतरण है; विक्रेता इस विशिष्ट प्रूफरीडिंग वर्कफ़्लो को निर्धारित नहीं करते हैं। इसका उद्देश्य ध्यान को अर्थ की ओर निर्देशित करना है, और फिर उन बिंदुओं को हल करने के लिए मूल छवि का उपयोग करना है जहां इसकी आवश्यकता है।

**पेज के क्रम और लेआउट की जांच करें।** पुष्टि करें कि पंक्तियां, कॉलम, शीर्षक या सूची के बिंदु उसी क्रम में पढ़े गए हैं जैसे वे मूल कॉपी में थे। छूटी हुई पंक्तियों या उस टेक्स्ट को देखें जो पास के कॉलम से संबंधित हो सकता है। ऊपर उल्लिखित OCR सेवाएं परिणामों को ब्लॉक और पैराग्राफ जैसे संरचनात्मक समूहों के साथ प्रस्तुत करती हैं, जिससे अलग-अलग शब्दों के साथ-साथ लेआउट की जांच करना भी उपयोगी हो जाता है।
**प्रभावशाली विवरणों को स्कैन करें।** पहचाने गए टेक्स्ट में तिथियां, संख्याएं, नाम और नकारात्मक शब्दों को खोजें। हस्तलेखन के साथ प्रत्येक विवरण की तुलना करें, जिसमें विराम चिह्न या प्रतीक भी शामिल हैं जो इसके अर्थ को बदल सकते हैं।
**स्रोत के साथ वाक्य-दर-वाक्य पढ़ें।** अक्षरों के स्पष्ट प्रतिस्थापन, जुड़े हुए या अलग हुए शब्दों, छूटे हुए शब्दों और डुप्लिकेट टेक्स्ट को ठीक करें। किसी संदेहास्पद निशान को समझने के लिए पूरे वाक्यांश का सहारा लें, लेकिन किसी उचित लगने वाले वाक्य के आधार पर ऐसे शब्द को स्वीकार न करें जिसकी पुष्टि लिखावट से नहीं होती।
**वास्तविक अनिश्चितता को चिह्नित करें।** यदि मूल लिखावट ही पढ़ने में कठिन है, तो शब्द को अनिश्चित के रूप में लेबल करें या बाद के लिए एक नोट छोड़ दें। इसे चुपचाप किसी अनुमान से न बदलें। यदि आप लेखक या किसी अन्य प्रतिलिपि से परामर्श कर सकते हैं, तो केवल उसी अनसुलझे विवरण के बारे में पूछें।
**सुधारे गए टेक्स्ट को अंतिम बार पढ़ें।** जांचें कि आपके संपादनों से कोई नई त्रुटि तो नहीं हुई है और विराम चिह्न, इकाइयां तथा लाइन ब्रेक अभी भी संदर्भ के अनुसार सही बैठते हैं।
खंड 4

उदाहरण: संदर्भ में किसी अस्पष्ट संख्या को स्पष्ट करना

मान लीजिए कि किसी हस्तलिखित नोट को इस प्रकार पहचाना गया है: “Send 18 copies by 6/12.” (6/12 तक 18 प्रतियां भेजें)। लेखक के "3" और "8" एक जैसे दिखते हैं, और तारीख को एक से अधिक तरीकों से पढ़ा जा सकता है। केवल निकाले गए वाक्य से निर्णय लेने के बजाय, दोनों हस्तलिखित विवरणों की अलग-अलग जांच करें। उस संदिग्ध अंक की तुलना पेज पर उसी अंक के अन्य उदाहरणों से करें; जांचें कि क्या आस-पास के नोट्स या शीर्षक यह स्पष्ट करते हैं कि किस दिनांक प्रारूप (date format) का उपयोग किया गया था। यदि नोट से फिर भी बात स्पष्ट नहीं होती है, तो किसी संभावित अर्थ को तथ्य मानने के बजाय अनिश्चितता को चिह्नित रहने दें।

यह एक उदाहरण देने वाली विधि है, न कि मापे गए पहचान प्रदर्शन की कोई रिपोर्ट। प्रासंगिक आदत यह है कि अनिश्चित विवरण को अलग करें, लेखक के अपने अक्षर या संख्या के प्रारूपों के साथ इसकी तुलना करें, और आसपास के संदर्भ का उपयोग केवल सहायक साक्ष्य के रूप में करें।

खंड 5

यदि कई पंक्तियां गलत हैं

जब कोई पूरा हिस्सा गड़बड़ हो, तो एक-एक अक्षर को बार-बार ठीक करने में मूल छवि को सुधारने और पहचान प्रक्रिया को फिर से चलाने की तुलना में अधिक समय लग सकता है। जांचें कि क्या लिखावट स्पष्ट रूप से दिखाई दे रही है, पूरा पेज फ्रेम में है, और टेक्स्ट किसी छाया, मोड़ या चमक (glare) में छिपा तो नहीं है। यदि आपका ऐप इमेज एडजस्टमेंट या नया कैप्चर करने की सुविधा देता है, तो एक स्पष्ट, अधिक समान रोशनी वाले दृश्य का प्रयास करें और नए परिणाम की तुलना पहले वाले से करें। जब तक आप उनकी जांच न कर लें, तब तक दोनों संस्करण रखें: एक नया प्रयास एक पंक्ति को ठीक कर सकता है और दूसरी को गलत पढ़ सकता है।

एकल अनिश्चित शब्द के लिए, पूरे पेज को दोबारा कैप्चर करना अनावश्यक हो सकता है। यदि टूल अनुमति देता है तो संबंधित क्षेत्र को ज़ूम करें या एक कॉपी को क्रॉप करें, साथ ही पंक्ति और शब्द के संदर्भ को दिखाने के लिए पर्याप्त आसपास की लिखावट को बनाए रखें। Google और Microsoft छवियों और दस्तावेज़ टेक्स्ट के लिए OCR का दस्तावेजीकरण करते हैं, लेकिन उनके पेज विशिष्ट सेवाओं का वर्णन करते हैं; वे यह स्थापित नहीं करते हैं कि प्रत्येक ऐप में समान नियंत्रण हैं या दूसरा पहचान प्रयास किसी विशेष पेज में सुधार ही करेगा।

खंड 6

जानें कि कब रुकना है और सत्यापन करना है

जब दो निष्कर्ष संभावित लगें और वह विवरण आपके कार्य को प्रभावित करता हो, तो अनुमान लगाना बंद कर दें। इसे अस्पष्ट के रूप में चिह्नित करें, कोई अन्य स्रोत प्रति खोजें, या किसी ऐसे व्यक्ति से पूछें जो उस लिखावट को पढ़ सकता हो। कम महत्व वाले व्यक्तिगत नोट्स के लिए, किसी अस्पष्ट निशान से जबरन निश्चितता निकालने में लंबा समय बिताने की तुलना में स्पष्ट रूप से "अस्पष्ट" लिख देना अक्सर अधिक उपयोगी होता है। उस टेक्स्ट के लिए जिसे साझा किया जाएगा या रिकॉर्ड के रूप में उपयोग किया जाएगा, उन पर निर्भर होने से पहले महत्वपूर्ण विवरणों की मूल स्रोत से अंतिम जांच अवश्य करें।

सबसे कुशल प्रूफरीडिंग चयनात्मक होती है लेकिन लापरवाह नहीं: परिणामों के आधार पर विवरणों को प्राथमिकता दें, उन्हें खोजने के लिए पहचाने गए टेक्स्ट का उपयोग करें, और हस्तलेखन के साथ प्रत्येक महत्वपूर्ण या अनिश्चित हिस्से की जांच करें। पहचान का परिणाम दोबारा टाइप करने से बचा सकता है, जबकि मूल पेज इस बात का प्रमाण बना रहता है कि क्या लिखा गया था।

खंड 7

स्रोत

[Google Cloud Vision दस्तावेज़: छवियों में लिखावट पहचानें](https://cloud.google.com/vision/docs/handwriting) — दस्तावेज़ टेक्स्ट डिटेक्शन, इसकी पेज/ब्लॉक/पैराग्राफ/शब्द संरचना और उन उदाहरणों की व्याख्या करता है जो कॉन्फिडेंस मान दिखाते हैं।
[Microsoft Learn: छवियों के लिए OCR](https://learn.microsoft.com/en-us/azure/ai-services/computer-vision/concept-ocr) — मुद्रित और हस्तलिखित टेक्स्ट निष्कर्षण का वर्णन करता है और एक उदाहरण प्रतिक्रिया में शब्द-स्तरीय टेक्स्ट, बाउंडिंग पॉलीगॉन और कॉन्फिडेंस दिखाता है।
संबंधित लेख

इस विषय को आगे पढ़ें