सत्यापित करने योग्य छह AI-जनरेटेड शोध विवरण
शोध-आधारित लेख का संपादन करने वाले लेखकों के लिए, यह जांचना महत्वपूर्ण कार्य है कि क्या प्रत्येक छोटा तथ्यात्मक विवरण स्रोत और उस दावे से मेल खाता है जिसके समर्थन में इसका उपयोग किया जा रहा है। नाम, तिथियां, संख्याएं, उद्धरण, स्रोत शीर्षक और दायरे से जुड़े शब्द भले ही गौण लग सकते हैं, फिर भी एक छोटा सा बदलाव किसी उद्धरण को खोजना कठिन बना सकता है या साक्ष्य को उसकी वास्तविक सीमा से अधिक बड़ा दिखा सकता है। प्रत्येक श्रेणी के साथ अलग तरह से पेश आएं: कुछ विवरणों को हूबहू प्रतिलेखन (transcription) की आवश्यकता होती है, जबकि अन्य को संदर्भ और सीमाओं की जांच की जरूरत होती है।
पहचान, वर्तनी और श्रेय (attribution) की जांच करें
नामों को किसी परिचित रूप में "सुधारना" आसान होता है। बीच का आद्याक्षर (middle initial) गायब हो सकता है, उपनाम की वर्तनी गलत हो सकती है, दो लेखकों को एक में मिलाया जा सकता है, या किसी संगठन को उस रिपोर्ट का श्रेय दिया जा सकता है जिसे उसने केवल होस्ट किया था। मिलते-जुलते नाम अलग-अलग व्यक्तियों की ओर भी संकेत कर सकते हैं। ये अलग-अलग त्रुटियां हैं: वर्तनी पहचान को प्रभावित करती है; श्रेय इस बात को प्रभावित करता है कि वह काम किसने किया या वह बात किसने कही।
स्रोत पृष्ठ से ही नाम की तुलना करें, विशेष रूप से उसकी बायलाइन, लेखक नोट या संगठन के आधिकारिक पृष्ठ से। किसी खोज-परिणाम स्निपेट या किसी अन्य लेख में कॉपी की गई ग्रंथसूची (bibliography) पर भरोसा न करें। शोध उद्धरण में, लेखक के क्रम और आद्याक्षरों के साथ-साथ वर्तनी की भी जांच करें: वे पाठकों को कार्य ढूंढने में मदद करते हैं। यदि स्रोत में किसी समूह लेखक का नाम है, तो व्यक्तिगत लेखकों का अनुमान लगाने के बजाय उस समूह के नाम को ही बनाए रखें।
**विपरीत उदाहरण:** एक स्रोत चार लेखकों में से एक के रूप में "M. Lee" को सूचीबद्ध करता है। इसे "Michael Lee" के रूप में विस्तारित करना क्योंकि संबंधित स्टाफ पेज पर Michael Lee मौजूद है, एक असमर्थित पहचान है, भले ही वह व्यक्ति वही क्यों न हो।
विश्वास करने योग्य दिखने वाले संदर्भ की सीधे जांच क्यों की जानी चाहिए, इसका एक वास्तविक उदाहरण वाल्टर्स और वाइल्डर के 2023 के ChatGPT-जनरेटेड ग्रंथसूची के अध्ययन से आता है। लेखकों ने 42 विषयों में साहित्य समीक्षाओं में तैयार किए गए संदर्भों की जांच की और मनगढ़ंत संदर्भों तथा वास्तविक संदर्भों में त्रुटियों, दोनों की सूचना दी। यह अध्ययन परीक्षण की गई प्रणालियों और संकेतों (prompts) से संबंधित है; यह प्रत्येक AI टूल या लेखन कार्य के लिए त्रुटि दर स्थापित नहीं करता है। ([Scientific Reports अध्ययन](https://www.nature.com/articles/s41598-023-41032-5))
घटना, प्रकाशन और अपडेट के बीच अंतर करें
कोई तारीख सटीक हो सकती है और फिर भी गलत प्रश्न का उत्तर दे सकती है। शोध पृष्ठ यह दिखा सकते हैं कि अध्ययन कब आयोजित किया गया था, पहली बार ऑनलाइन कब प्रकाशित हुआ, किसी जर्नल अंक को कब सौंपा गया, अपडेट कब किया गया, या कब देखा (accessed) गया। रिपोर्ट उस अवधि को भी कवर कर सकती हैं जो उनकी प्रकाशन तिथि से भिन्न होती है। जब लेख कहता है कि "अध्ययन 2021 में सामने आया," तो बाद के वेबपेज अपडेट की तारीख का उपयोग करना भ्रामक होगा, भले ही वह अपडेट तिथि प्रमुखता से प्रदर्शित की गई हो।
दावे की क्रिया (verb) और संज्ञा (noun) से तारीख का मिलान करें। "प्रकाशित" के लिए प्रकाशन तिथि की आवश्यकता होती है; "सर्वेक्षण किया गया" के लिए फील्डवर्क अवधि की आवश्यकता होती है; "अपडेट किया गया" के लिए संशोधन तिथि की आवश्यकता होती है। यदि कोई स्रोत केवल एक वर्ष देता है, तो मनगढ़ंत महीना या दिन न जोड़ें। जब दो वैध तिथियां महत्वपूर्ण हों, तो चुपचाप किसी एक को चुनने के बजाय दोनों को स्पष्ट रूप से अंकित करें।
**विपरीत उदाहरण:** एक रिपोर्ट पृष्ठ कहता है "14 मार्च 2024 को अपडेट किया गया" और 2022 में किए गए एक सर्वेक्षण का वर्णन करता है। इसे "2024 का सर्वेक्षण" कहना पृष्ठ के अपडेट को डेटा संग्रह अवधि के साथ भ्रमित करता है।
इकाई, भाजक (denominator) और तुलना को सत्यापित करें
संख्याएं अक्सर व्याख्या (paraphrase) के बाद भी बच जाती हैं जबकि उनका अर्थ बदल जाता है। इकाई (लोग, शोधपत्र, उद्धरण या प्रतिक्रियाएं), भाजक, समयावधि, जनसंख्या की जांच करें और यह भी देखें कि क्या आंकड़ा एक गिनती, प्रतिशत, अनुमान या राउंड ऑफ किया गया मान है। फिर तुलना की जांच करें: "10% बढ़ा" और "10 प्रतिशत अंक बढ़ा" एक दूसरे के स्थान पर प्रयोग नहीं किए जा सकते। त्रुटि वाले उद्धरणों का अनुपात कम से कम एक त्रुटि वाले लेखों के अनुपात के समान नहीं होता है।
उस तालिका, चार्ट, कार्यप्रणाली या स्रोत अंश पर वापस जाएं जहां से आंकड़ा निकला है। पुनर्गणना केवल तभी करें जब इनपुट और संक्रिया (operation) स्पष्ट हों; अन्यथा स्रोत के बताए गए आंकड़े को ही उद्धृत करें और उसके विशेषणों/शर्तों (qualifiers) को बनाए रखें। एक संकीर्ण नमूने के परिणाम को एक सामान्य आवृत्ति के दावे में न बदलें।
एक सरल उदाहरण के लिए, 20 में से 12 गैलरी आगंतुक और 40 में से 20 गैलरी आगंतुक अलग-अलग गिनती हैं, फिर भी पहला 60% है और दूसरा 50% है। एक AI सारांश जो केवल "20 आगंतुकों" या केवल एक प्रतिशत की प्रतिलिपि बनाता है, वह उस तुलना को छोड़ देता है जो दावे को समझने के लिए आवश्यक है। ये आंकड़े केवल उदाहरण के लिए गढ़े गए हैं; मूल तालिका और उसके नोट्स से वास्तविक संख्याओं का सत्यापन करें।
उद्धरण: शब्दों और वक्ता का सत्यापन करें
उद्धरण चिह्नों में लिखा गया एक धाराप्रवाह वाक्य एक सटीक उद्धरण, एक ढीला-ढाला सारांश, या मॉडल द्वारा गढ़ा गया पाठ हो सकता है। मूल अंश ढूंढें और शब्दों, वक्ता, तिथि और आसपास के संदर्भ की जांच करें। किसी समूह के नाम दिया गया उद्धरण वास्तव में किसी एक प्रतिभागी द्वारा बोला गया हो सकता है; एक यादगार वाक्यांश प्रतिभागी के शब्दों के बजाय लेख के लेखक का सारांश हो सकता है।
यदि मूल स्रोत में सटीक शब्द नहीं हैं, तो उद्धरण चिह्न हटा दें। स्रोत वास्तव में जो कहता है उसे अपने शब्दों में लिखें और उसे उद्धृत करें, या जब आप इसकी पुष्टि न कर सकें तो उस पंक्ति को छोड़ दें। किसी उद्धरण को सटीक रूप में प्रस्तुत करते हुए चुपचाप उसे अधिक सहज गद्य में न बदलें।
स्रोत शीर्षक और पहचानकर्ता: संदर्भ को खोजने योग्य बनाए रखें
एक संभावित लेख शीर्षक इस बात का प्रमाण नहीं है कि लेख अस्तित्व में है। प्रकाशक के पृष्ठ या ग्रंथसूची अनुक्रमणिका (bibliographic index) में सटीक शीर्षक और लेखक को खोजें, फिर DOI, तिथि और जर्नल या पुस्तक शीर्षक की तुलना करें। शीर्षक में बदला हुआ एक शब्द किसी भिन्न कार्य या बिना किसी कार्य की ओर ले जा सकता है। Crossref की मेटाडेटा खोज किसी पंजीकृत प्रकाशन का पता लगाने में मदद कर सकती है, लेकिन एक मेल खाता रिकॉर्ड अभी भी यह नहीं दिखाता है कि वह कार्य उद्धरण के बगल वाले वाक्य का समर्थन करता है।
वाल्टर्स और वाइल्डर ने 2023 में GPT-3.5 और GPT-4 द्वारा उत्पन्न 84 संक्षिप्त समीक्षाओं में 636 संदर्भों की जांच की। उन्होंने मनगढ़ंत संदर्भों और वास्तविक कार्यों के संदर्भों के भीतर त्रुटियों की सूचना दी। परिणाम उन परीक्षण किए गए संस्करणों और संकेतों पर लागू होता है; यह संदर्भों की जांच के लिए साक्ष्य है, न कि प्रत्येक AI लेखन उपकरण के लिए वर्तमान त्रुटि दर।
दायरे से जुड़े शब्द: जांचें कि कौन, कहां, कब और कितनी दृढ़ता से
छोटे शब्द चुपचाप किसी दावे का विस्तार कर सकते हैं। "कुछ," "सभी," "आमतौर पर," "कारण बना," और "साबित हुआ" अलग-अलग बातें कहते हैं। यदि कोई स्रोत एक तिथि पर एक कार्यशाला की रिपोर्ट करता है, तो सभी कार्यशालाओं के बारे में एक पैराग्राफ साक्ष्य से कहीं अधिक व्यापक है। यदि दो मापदंड एक साथ बदले हैं, तो एक को दूसरे का कारण कहना उनके साझा समय से अधिक समर्थन की मांग करता है।
प्रत्येक उस वाक्यांश को चिह्नित करें जो मूल खोज का विस्तार करता है: एक बड़ा दर्शक वर्ग, लंबी अवधि, नई सेटिंग, मजबूत निश्चितता या कारण बताने वाली क्रिया। वाक्य में स्रोत की सीमाओं को पुनर्स्थापित करें। यदि स्रोत कहता है "इस परीक्षण के प्रतिभागी," तो उस समूह को बनाए रखें। यदि यह "हो सकता है" कहता है, तो इसे "होगा" में न बदलें। यह जांच पूछती है कि साक्ष्य में क्या शामिल है, न कि यह कि वाक्य केवल आश्वस्त लगता है या नहीं।
प्रकाशन से पहले छह-विवरण स्कैन
नामों, तिथियों, संख्याओं, उद्धरणों, स्रोत शीर्षकों और दायरे से जुड़े शब्दों पर एक केंद्रित समीक्षा चलाएं। प्रत्येक विवरण के लिए पूछें कि क्या मूल स्रोत इस सटीक रूप का समर्थन करता है और क्या कोई पाठक इसे ढूंढ सकता है। जांच में विफल रहने वाले विवरण को सही करें, सीमित करें या हटा दें। फिर पैराग्राफ को एक बार और पढ़कर पुष्टि करें कि सुधारे गए विवरण अभी भी इसके समग्र अर्थ का समर्थन करते हैं।
यह स्कैन जानबूझकर एक संपूर्ण तर्क या स्रोत-गुणवत्ता समीक्षा से अधिक संकीर्ण है। यह छोटे तथ्यात्मक परिवर्तनों को पकड़ता है जो अन्यथा सावधानीपूर्वक लिखे गए शोध लेख को अविश्वसनीय बना सकते हैं, जबकि संरचना और तर्क से संबंधित व्यापक निर्णयों को एक अलग संपादकीय समीक्षा के लिए छोड़ देता है।
