Metlivi ब्लॉग

सत्रों के पार किसी यूज़र सुधार को कैरेक्टर चैट में कैसे याद रखवाएं

जब कोई यूज़र किसी काल्पनिक कैरेक्टर के विवरण को सही करता है, तो चैट को सही किए गए संस्करण को उसके स्कोप के साथ सहेजना चाहिए, किसी भी परस्पर विरोधी पुराने संस्करण को बदलना चाहिए, और सहेजे गए नोट को दृश्यमान व संपादन योग्य बनाना चाहिए। इसे उपयोगकर्ता की स्थायी प्राथमिकताओं और केवल एक कहानी दृश्य के भीतर लागू होने वाले तथ्यों के बीच भी अंतर करना चाहिए। बाद में किसी याद रखे गए विवरण का उपयोग करने से पहले, सिस्टम को यह जांचना चाहिए कि क्या वह प्रासंगिक और अद्यतित है; यदि साक्ष्य स्पष्ट नहीं है, तो मनगढ़ंत साझा अतीत बनाने के बजाय उसे पूछना चाहिए। यह गाइड उस स्थायित्व और संघर्ष-समाधान (कन्फ्लिक्ट रिज़ॉल्यूशन) कार्य पर केंद्रित है, न कि इस बात पर कि उस क्षण किसी गलतफहमी पर क्या प्रतिक्रिया दी जाए।

27 सितंबर 20268 मिनट का पठनपढ़ना, कला और संस्कृतिलेखक: Metlivi Editorial Team
खंड 1

एक कैरेक्टर चैट को क्या याद रखना चाहिए?

एक उदाहरण पर विचार करें: एक यूज़र कहता है, “मीरा की आँखें हरी हैं, नीली नहीं।” यह सुधार किसी स्थायी कैरेक्टर विवरण, किसी विशेष रोल-प्ले में मीरा के अस्थायी संस्करण, या केवल मीरा के विवरण के तरीके को लेकर यूज़र की पसंद का संदर्भ दे सकता है। ऐसी मेमोरी जो केवल “आँखें: हरी” संग्रहीत करती है, वह उस संदर्भ को खो देती है जो तथ्य को उपयोगी बनाता है।

एक व्यावहारिक मेमोरी रिकॉर्ड में कम से कम विषय, सुधारा गया विवरण, स्कोप और यह जानकारी दर्ज होनी चाहिए कि क्या यूज़र इसे स्थायी रखना चाहता था। उदाहरण के लिए:

यह संरचना उत्पाद-डिज़ाइन की एक सिफारिश है, अध्ययनों द्वारा निर्धारित कोई प्रारूप नहीं। इसका उद्देश्य किसी स्थानीय दृश्य के विवरण को चुपचाप वैश्विक तथ्य बनने से रोकना है। एक दृश्य-विशिष्ट सुधार को इसके बजाय इस रूप में दर्ज किया जा सकता है: “विंटर-बॉल दृश्य में, मीरा ने हरा लबादा पहना हुआ है।” उस नोट को उसकी सामान्य वेशभूषा या रूप-रंग को अधिलेखित (ओवरराइट) नहीं करना चाहिए।

विषय: मीरा, काल्पनिक कैरेक्टर
विवरण: हरी आँखें
स्कोप: मीरा का सामान्य कैरेक्टर विवरण
स्थिति: वर्तमान; पिछले “नीली आँखें” वाले नोट की जगह लेता है
स्रोत: यूज़र सुधार
खंड 2

एक सुधार को पुरानी मेमोरी की जगह कैसे लेनी चाहिए?

एक स्पष्ट सुधार को प्रासंगिक तथ्य के अपडेट के रूप में मानें, न कि किसी अतिरिक्त तथ्य के रूप में जो दोनों संस्करणों को सक्रिय छोड़ दे। यदि सिस्टम “मीरा की आँखें नीली हैं” को बनाए रखता है और “मीरा की आँखें हरी हैं” जोड़ता है, तो बाद में जानकारी प्राप्त करते समय दोनों में से कोई भी सामने आ सकता है। अपडेट किए गए रिकॉर्ड को पुराने मान को अधिक्रमित (सुपरसीड) के रूप में चिह्नित करना चाहिए या इसे सक्रिय उपयोग से हटा देना चाहिए, साथ ही परिवर्तन को समझाने के लिए पर्याप्त इतिहास को सुरक्षित रखना चाहिए यदि उत्पाद मेमोरी लॉग प्रदान करता है।

यह अंतर इसलिए मायने रखता है क्योंकि जानकारी समय के साथ बदल सकती है। *[Keep Me Updated! Memory Management in Long-term Conversations](https://aclanthology.org/2022.findings-emnlp.276/)* में, बे और उनके सहयोगियों ने कई वार्तालाप सत्रों में उपयोगकर्ताओं के बारे में अपडेट की गई जानकारी को ट्रैक करने के लिए एक कार्य और डेटासेट पेश किया है। वे स्मृतियों को टेक्स्ट विवरण के रूप में दर्शाते हैं और अमान्य या अनावश्यक जानकारी को चुनिंदा रूप से समाप्त करने का प्रस्ताव करते हैं। उनके प्रयोग इस दृष्टिकोण की तुलना ऐसे आधारभूत मॉडलों (बेसलाइन्स) से करते हैं जो संग्रहीत स्मृतियों को अपरिवर्तित छोड़ देते हैं। यह अध्ययन दीर्घकालिक संवादात्मक मेमोरी से संबंधित है; यह विशेष रूप से काल्पनिक कैरेक्टर चैट का परीक्षण नहीं करता है या कोई सार्वभौमिक मेमोरी डिज़ाइन स्थापित नहीं करता है।

कैरेक्टर चैट के लिए, इसी सामान्य अपडेट तर्क को सावधानी से लागू करें: एक सीधा “नीली नहीं—हरी” सुधार इस बात का मजबूत प्रमाण है कि पुराना मान बताए गए स्कोप के भीतर गलत है। एक नया दृश्य विवरण स्वचालित रूप से इस बात का प्रमाण नहीं है कि कैरेक्टर का कोई स्थायी तथ्य बदल गया है। जब स्कोप का अभाव हो और यह अंतर बाद में मायने रखता हो, तो एक संक्षिप्त अनुवर्ती प्रश्न पूछें जैसे, “क्या मुझे हर कहानी में मीरा के लिए हरी आँखें याद रखनी चाहिए, या सिर्फ इसी संस्करण के लिए?”

खंड 3

सिस्टम यूज़र की प्राथमिकताओं को कहानी के तथ्यों से कैसे अलग कर सकता है?

प्राथमिकताओं और काल्पनिक दुनिया के तथ्यों को अलग-अलग श्रेणियों में संग्रहीत करें। एक प्राथमिकता हो सकती है “यूज़र मीरा के संवादों को संक्षिप्त रखना पसंद करता है।” कहानी का तथ्य हो सकता है “इस दृश्य में, मीरा अभी-अभी स्टेशन पर पहुँची है।” वे अलग-अलग सवालों के जवाब देते हैं: प्राथमिकता इस बात का मार्गदर्शन करती है कि चैट कैसे प्रतिक्रिया देती है, जबकि कहानी का तथ्य एक कथा के भीतर निरंतरता बनाए रखने में मदद करता है।

दोनों में स्कोप जोड़ें। एक प्राथमिकता सभी चैट पर, किसी एक कैरेक्टर पर, या केवल वर्तमान रोल-प्ले पर लागू हो सकती है। कहानी का तथ्य एक दृश्य, एक कहानी चाप (स्टोरी आर्क), या कैरेक्टर के सामान्य प्रोफ़ाइल पर लागू हो सकता है। किसी एक सुधार से व्यापक प्राथमिकता का अनुमान न लगाएं। यदि कोई यूज़र कहता है “मीरा की आँखें हरी हैं,” तो इसका अपने आप यह मतलब नहीं है कि यूज़र चाहता है कि हर कैरेक्टर की आँखें हरी हों, या यह विवरण मीरा के हर वैकल्पिक संस्करण पर लागू होता है।

एक सरल निर्णय क्रम मदद करता है:

ये चरण संवादात्मक जानकारी को अद्यतित रखने की समस्या से तैयार किया गया एक प्रस्तावित वर्कफ़्लो हैं। यह कोई दावा नहीं है कि कोई विशेष चैट उत्पाद इनका पालन करता है।

पहचानें कि सुधार किस संदर्भ में है: यूज़र की प्राथमिकता, कैरेक्टर की विशेषता, या वर्तमान दृश्य की स्थिति।
यूज़र द्वारा बताए गए स्कोप को सुरक्षित रखें, जिसमें “इस कहानी में” या “अब से” जैसी सीमाएं शामिल हैं।
यदि स्कोप मौजूद नहीं है, तो केवल सबसे संकीर्ण उचित व्याख्या का उपयोग करें या सत्र-पार (क्रॉस-सेशन) मेमोरी सहेजने से पहले पूछें।
समान विषय और स्कोप के बारे में पुरानी मेमोरी की जांच करें। इसे केवल तभी अधिक्रमित करें जब नया कथन वास्तव में परस्पर विरोधी हो।
असंबंधित यादों को अक्षुण्ण रखें। मीरा की आँखों का रंग बदलने से उसकी उम्र, रिश्ते या यूज़र की पसंदीदा लेखन शैली नहीं बदलनी चाहिए।
खंड 4

इसे परस्पर विरोधी यादों को कैसे संभालना चाहिए?

विषय, स्कोप और समय की तुलना करके विरोधों को हल करें—न कि आँख मूंदकर उस वाक्य का पक्ष लेकर जिसे पुनः प्राप्त करना सबसे आसान हो। यूज़र की ओर से बाद में किया गया स्पष्ट सुधार आम तौर पर उसी स्कोप में उसी तथ्य के पुराने संस्करण पर वरीयता प्राप्त करना चाहिए। किसी भिन्न रोल-प्ले का विवरण वर्तमान विवरण को ओवरराइड नहीं करना चाहिए। यदि सिस्टम यह नहीं बता सकता कि क्या दो रिकॉर्ड किसी कैरेक्टर के एक ही संस्करण को संदर्भित करते हैं, तो उसे उन्हें अलग रखना चाहिए या पूछना चाहिए।

उदाहरण के लिए, मान लें कि एक पुरानी मेमोरी कहती है, “मीरा की आँखें नीली हैं,” जबकि बाद का संदेश कहता है, “इस वैकल्पिक-ब्रह्मांड की कहानी के लिए, मीरा की आँखें हरी हैं।” बाद का कथन उस कहानी के लिए मीरा के रूप-रंग को अपडेट करता है, लेकिन जरूरी नहीं कि डिफ़ॉल्ट कैरेक्टर प्रोफ़ाइल को बदल दे। यदि यूज़र कहता है, “वास्तव में, अब से उसकी आँखों का रंग हरा कर दो,” तो स्कोप व्यापक है और डिफ़ॉल्ट रिकॉर्ड को अपडेट किया जा सकता है। विरोधाभासी संस्करणों को चुपचाप इस दावे में न मिलाएं कि यूज़र ने हमेशा मीरा का वर्णन इसी तरह किया है।

मेमोरी सिस्टम को अनिश्चितता को संभालने के तरीके की भी आवश्यकता होती है। यदि दो रिकॉर्ड्स की तारीखें या स्कोप अस्पष्ट हैं, तो किसी भी विवरण को आत्मविश्वास से प्रस्तुत करने के बजाय संघर्ष को अनसुलझा चिह्नित करें। एक आश्वस्त लेकिन निराधार स्मरण की तुलना में एक छोटा प्रश्न पूछना बेहतर है।

खंड 5

यूज़र कैसे देख सकते हैं और नियंत्रित कर सकते हैं कि क्या याद रखा गया था?

सुधार सहेजने के बाद, विशिष्ट परिवर्तन की पुष्टि करें: “समझ गया—मैं मीरा के सामान्य कैरेक्टर प्रोफ़ाइल में उसकी हरी आँखों को याद रखूँगा, जो पहले के नीली आँखों वाले विवरण की जगह लेगा।” यदि सिस्टम कोई संकीर्ण तथ्य सहेज रहा है, तो ऐसा कहें: “मैं इस दृश्य के विवरण के रूप में हरे लबादे को रखूँगा।” वह पुष्टि यूज़र को स्कोप की गलती को तुरंत पकड़ने का मौका देती है।

मेमोरी व्यू में सहेजे गए शब्दों और उसके स्कोप को सरल भाषा में दिखाया जाना चाहिए, जिसमें इसे संपादित करने या हटाने का तरीका भी हो। यदि उत्पाद अधिक्रमित प्रविष्टियों को प्रदर्शित कर सकता है, तो उसे उन्हें समान रूप से वर्तमान दिखाने के बजाय पुराना (आउटडेटेड) लेबल करना चाहिए। इससे उपयोगकर्ताओं के लिए यह समझना आसान हो जाता है कि कोई कैरेक्टर चैट किसी विवरण को क्यों सामने लाती है और पूरी कहानी को दोहराए बिना रिकॉर्ड को सही करना आसान हो जाता है।

जब कोई मेमोरी सहेजी न गई हो तो उसके अस्तित्व का संकेत देने से बचें, या यह दावा करने से बचें कि कैरेक्टर को कोई पिछली बातचीत याद है जिसे सिस्टम सत्यापित नहीं कर सकता। कैरेक्टर स्वाभाविक रूप से बात कर सकता है, जबकि इंटरफ़ेस या प्रतिक्रिया इस बात को लेकर ईमानदार रहती है कि कौन सी जानकारी संग्रहीत है।

खंड 6

बाद के रिकॉल का परीक्षण कैसे किया जाना चाहिए?

सत्रों के पार स्थायित्व का परीक्षण करें, न कि केवल उसी बातचीत में जहां सुधार किया गया था। [यांग और एटिंगर द्वारा स्थितिगत-समझ का अध्ययन](https://aclanthology.org/2023.emnlp-main.394/) एक सिंथेटिक वातावरण का उपयोग करके ChatGPT का मूल्यांकन करता है जिसे यह परीक्षण करने के लिए डिज़ाइन किया गया है कि क्या यह बदलते वातावरण की स्थितियों को ट्रैक करता है और रिपोर्ट करता है। लेखक समय के साथ स्थितियों को बनाए रखने में त्रुटियों की रिपोर्ट करते हैं और अपनी सेटिंग में कारकों के रूप में गैर-स्थायी इन-कॉन्टेक्स्ट मेमोरी और मतिभ्रमित (हैलुसिनेटेड) अपडेट के प्रति संवेदनशीलता पर चर्चा करते हैं। यह उस वातावरण में ChatGPT का एक नियंत्रित अध्ययन था, जो 2023 में प्रकाशित हुआ था; यह हर वर्तमान मॉडल, उत्पाद या काल्पनिक-कैरेक्टर प्रणाली के बारे में प्रमाण नहीं है।

एक कैरेक्टर चैट के लिए एक केंद्रित परीक्षण स्क्रिप्टेड बातचीत के एक छोटे सेट का उपयोग कर सकता है:

प्रत्येक परीक्षण को इच्छित स्कोप के आधार पर स्कोर करें: सही पुनर्प्राप्ति, पुरानी जानकारी का सही प्रतिस्थापन, दृश्य और सामान्य तथ्यों का पृथक्करण, और अनिश्चितता का ईमानदार संचालन। ऐसे मामलों को शामिल करें जहाँ अपेक्षित उत्तर स्पष्टीकरण मांगना हो। एक ऐसा सिस्टम जो अपने संग्रहीत नोट्स के अस्पष्ट होने पर अनुमान लगाने से मज़बूती से इनकार करता है, वह निरंतरता का मनगढ़ंत निर्माण करने वाले सिस्टम की तुलना में उस मामले को बेहतर ढंग से संभाल रहा होता है।

एक डिफ़ॉल्ट कैरेक्टर तथ्य सेट करें, इसे सही करें, सत्र समाप्त करें, और एक नए सत्र में इसके बारे में पूछें।
केवल-दृश्य विवरण सहेजें और जांचें कि यह एक स्थायी कैरेक्टर विशेषता न बन जाए।
एक प्राथमिकता बदलें और पुष्टि करें कि पुरानी प्राथमिकता अब बताए गए स्कोप के भीतर बाद के उत्तरों का मार्गदर्शन नहीं करती है।
उसी कैरेक्टर का दूसरा संस्करण पेश करें और जांचें कि दोनों संस्करण अलग-अलग रहें।
किसी असंबंधित विवरण के बारे में पूछें और सत्यापित करें कि सुधार ने अन्य यादों को नहीं बदला है।
पूछें कि यूज़र ने पहले क्या कहा था और जांचें कि सिस्टम अपने उत्तर को सही ठहराने के लिए किसी पूर्व बातचीत को गढ़ता तो नहीं है।
खंड 7

सुधार से रिकॉल तक का एक भरोसेमंद मार्ग

एक सुधार को एक स्पष्ट मार्ग से आगे बढ़ना चाहिए: इसके विषय की पहचान करें, इसके स्कोप को सुरक्षित रखें, किसी भी परस्पर विरोधी मेमोरी को अपडेट करें, सहेजे गए परिवर्तन को दिखाएं, और सत्यापित करें कि बाद की प्रतिक्रियाएं इसे अप्रमाणित इतिहास में बदले बिना पुनः प्राप्त करती हैं। वह क्रम कैरेक्टर चैट को काल्पनिक दुनिया का नियंत्रण यूज़र के पास छोड़ते हुए मोड़ों और सत्रों के बीच सुसंगत बने रहने का एक व्यावहारिक तरीका देता है। शोध मेमोरी अपडेट और स्टेट ट्रैकिंग को गंभीरता से लेने का समर्थन करता है; यहाँ दिया गया विशिष्ट वर्कफ़्लो एक डिज़ाइन सिफारिश है, और इसके व्यवहार को उस उत्पाद में जांचा जाना चाहिए जहाँ इसका उपयोग किया जाएगा।

संबंधित लेख

इस विषय को आगे पढ़ें