كيف تجعل محادثة الشخصية تتذكر تصحيحات المستخدم عبر الجلسات المختلفة
عندما يصحح المستخدم تفاصيل شخصية خيالية، يجب على المحادثة حفظ النسخة المصححة مع نطاقها، واستبدال أي نسخة سابقة متعارضة، وجعل الملاحظة المحفوظة مرئية وقابلة للتعديل. كما ينبغي لها التمييز بين تفضيلات المستخدم الدائمة والحقائق التي تنطبق فقط داخل مشهد قصصي واحد. وقبل استخدام تفصيلة متذكرة لاحقًا، يجب على النظام التحقق من أنها ذات صلة وحديثة؛ وإذا كانت الأدلة غير واضحة، فيجب عليه السؤال بدلاً من اختلاق ماضٍ مشترك. يركز هذا الدليل على مهمة الاستمرارية وحل التعارضات، وليس على كيفية الرد على سوء الفهم في اللحظة نفسها.
ما الذي يجب أن تتذكره محادثة الشخصية؟
فكر في مثال توضيحي: يقول مستخدم: "عينا ميرا خضراوان وليستا زرقاوين". قد يشير التصحيح إلى تفصيلة دائمة في الشخصية، أو نسخة مؤقتة من ميرا في لعب أدوار معين، أو ببساطة تفضيل المستخدم لكيفية وصف ميرا. إن الذاكرة التي تخزن فقط "العيون: خضراء" تفقد السياق الذي يجعل الحقيقة مفيدة.
يجب أن يلتقط سجل الذاكرة العملي على الأقل الموضوع، والتفصيلة المصححة، والنطاق، وما إذا كان المستخدم يقصد استمرارها. على سبيل المثال:
هذا الهيكل هو توصية لتصميم المنتج، وليس تنسيقًا تفرضه الدراسات. والغرض منه هو منع تحول تفصيلة مشهد محلي بهدوء إلى حقيقة عامة. قد يتم تسجيل تصحيح خاص بالمشهد بدلاً من ذلك على أنه "في مشهد الحفلة الشتوية، ترتدي ميرا عباءة خضراء". لا ينبغي أن تلغي تلك الملاحظة زيها العام أو مظهرها العام.
كيف ينبغي للتصحيح أن يحل محل الذاكرة القديمة؟
تعامل مع التصحيح الواضح كتحديث للحقيقة المعنية، وليس كحقيقة إضافية تترك كلا النسختين نشطتين. إذا احتفظ النظام بعبارة "ميرا لها عينان زرقاوان" وأضاف "ميرا لها عينان خضراوان"، فإن الاسترجاع اللاحق قد يظهر أحدهما عشوائيًا. يجب أن يحدد السجل المحدث القيمة القديمة على أنها مستبدلة أو يزيلها من الاستخدام النشط، مع الحفاظ على سجل تاريخي كافٍ لشرح التغيير إذا كان المنتج يوفر سجل ذاكرة.
هذا التمييز مهم لأن المعلومات يمكن أن تتغير بمرور الوقت. في دراسة *[Keep Me Updated! Memory Management in Long-term Conversations](https://aclanthology.org/2022.findings-emnlp.276/)*، يقدم باي وزملاؤه مهمة ومجموعة بيانات لتتبع المعلومات المحدثة حول المستخدمين عبر جلسات محادثة متعددة. وهم يمثلون الذكريات كأوصاف نصية ويقترحون التخلص الانتقائي من المعلومات غير الصالحة أو المكررة. تقارن تجاربهم هذا النهج بنماذج أساسية تترك الذكريات المخزنة دون تغيير. تتعلق الدراسة بالذاكرة الحوارية طويلة المدى؛ وهي لا تختبر محادثات الشخصيات الخيالية على وجه التحديد أو تضع تصميم ذاكرة عالمي واحد.
بالنسبة لمحادثة الشخصية، طبق منطق التحديث العام نفسه بعناية: التصحيح المباشر "ليست زرقاء—بل خضراء" هو دليل قوي على أن القيمة القديمة خاطئة ضمن النطاق المحدد. وتفصيلة المشهد الجديد ليست تلقائيًا دليلاً على تغير حقيقة دائمة للشخصية. عندما يكون النطاق مفقودًا ويكون الفارق مهمًا لاحقًا، اطرح سؤال متابعة موجزًا مثل: "هل يجب أن أتذكر العيون الخضراء لميرا في كل قصة، أم في هذه النسخة فقط؟"
كيف يمكن للنظام فصل تفضيلات المستخدم عن حقائق القصة؟
قم بتخزين التفضيلات وحقائق العالم الخيالي في فئات متميزة. قد يكون التفضيل: "يفضل المستخدم أن يكون حوار ميرا موجزًا". وقد تكون حقيقة القصة: "في هذا المشهد، وصلت ميرا للتو إلى المحطة". إنهما يجيبان عن أسئلة مختلفة: يوجه التفضيل كيفية استجابة المحادثة، بينما تساعد حقيقة القصة في الحفاظ على الاستمرارية داخل السرد.
أضف نطاقًا لكليهما. يمكن أن ينطبق التفضيل عبر المحادثات، أو على شخصية واحدة، أو فقط على لعب الأدوار الحالي. يمكن أن تنطبق حقيقة القصة على مشهد واحد، أو قوس قصصي واحد، أو الملف التعريفي العام للشخصية. لا تستنتج تفضيلًا عامًا من تصحيح واحد. إذا قال مستخدم "عينا ميرا خضراوان"، فهذا لا يعني بحد ذاته أن المستخدم يريد أن يمتلك كل شخصية عيونًا خضراء، أو أن التفصيلة تنطبق على كل نسخة بديلة من ميرا.
يساعد تسلسل القرارات البسيط التالي:
هذه الخطوات هي مسار عمل مقترح مستمد من مشكلة إبقاء المعلومات الحوارية محدثة. وهي ليست ادعاءً بأن أي منتج محادثة بعينه يتبعها.
كيف ينبغي التعامل مع الذكريات المتضاربة؟
قم بحل النزاعات من خلال مقارنة الموضوع والنطاق والوقت—وليس من خلال تفضيل الجملة الأسهل في الاسترجاع بشكل أعمى. يجب أن يكون للتصحيح الواضح واللاحق من المستخدم الأسبقية عمومًا على نسخة سابقة من نفس الحقيقة في نفس النطاق. ولا ينبغي لتفصيلة من لعب أدوار مختلف أن تتجاوز التفصيلة الحالية. إذا لم يتمكن النظام من معرفة ما إذا كان سجلان يشيران إلى نفس النسخة من الشخصية، فيجب عليه إبقاؤهما منفصلين أو الاستفسار.
على سبيل المثال، افترض أن ذاكرة أقدم تقول: "ميرا لها عينان زرقاوان"، بينما تقول رسالة لاحقة: "بالنسبة لقصة هذا الكون البديل، فإن ميرا لها عينان خضراوان". يحدث البيان اللاحق مظهر ميرا لتلك القصة، ولكنه لا يغير بالضرورة الملف التعريفي الافتراضي للشخصية. إذا قال المستخدم: "في الواقع، اجعل الأخضر هو لون عينيها من الآن فصاعدًا"، فإن النطاق يكون أوسع ويمكن تحديث السجل الافتراضي. لا تدمج النسخ المتناقضة بهدوء في ادعاء بأن المستخدم كان دائمًا يصف ميرا بالطريقة نفسها.
تحتاج أنظمة الذاكرة أيضًا إلى طريقة للتعامل مع عدم اليقين. إذا كان لسجلين تواريخ أو نطاقات غير واضحة، فحدد التعارض على أنه لم يتم حله بدلاً من تقديم أي من التفصيلتين بثقة. إن طرح سؤال قصير أفضل من إظهار تذكر واثق ولكنه غير مدعوم بأدلة.
كيف يمكن للمستخدمين رؤية ما تم تذكره والتحكم فيه؟
بعد حفظ التصحيح، أكد التغيير المحدد: "فهمت—سأتذكر أن ميرا ذات عيون خضراء في ملف شخصيتها العام، مستبدلاً تفصيلة العيون الزرقاء السابقة". وإذا كان النظام يحفظ حقيقة أضيق، فاذكر ذلك: "سأحتفظ بالعباءة الخضراء كتفصيلة لهذا المشهد". يمنح هذا التأكيد المستخدم فرصة لتدارك خطأ في النطاق على الفور.
يجب أن تعرض شاشة الذاكرة الصياغة المحفوظة ونطاقها بلغة بسيطة، مع وسيلة لتعديلها أو حذفها. وإذا كان المنتج قادرًا على عرض الإدخالات المستبدلة، فيجب عليه تصنيفها على أنها قديمة بدلاً من إظهارها على أنها حديثة بذات القدر. وهذا يسهل على المستخدمين فهم سبب استحضار محادثة الشخصية لتفصيلة ما، وتصحيح السجل دون الحاجة إلى تكرار القصة بأكملها.
تجنب الإيحاء بوجود ذاكرة عندما لا يتم حفظها، أو الادعاء بأن الشخصية تتذكر حوارًا سابقًا لا يمكن للنظام التحقق منه. يمكن للشخصية التحدث بشكل طبيعي بينما تظل الواجهة أو الاستجابة صادقة بشأن المعلومات المخزنة.
كيف ينبغي اختبار دقة الاسترجاع لاحقًا؟
اختبر الاستمرارية عبر الجلسات، وليس فقط في نفس المحادثة التي تم فيها التصحيح. تقيم [دراسة الفهم الظرفي التي أجراها يانغ وإيتنجر](https://aclanthology.org/2023.emnlp-main.394/) نموذج ChatGPT باستخدام بيئة اصطناعية مصممة لاختبار ما إذا كان يتتبع حالات البيئة المتغيرة ويبلغ عنها. يفيد المؤلفون بوجود أخطاء في الاحتفاظ بالحالات بمرور الوقت ويناقشون الذاكرة غير المستمرة داخل السياق وقابلية التأثر بالتحديثات المهلوسة كعوامل في بيئتهم. كانت هذه دراسة مضبوطة لـ ChatGPT في تلك البيئة، نُشرت في عام 2023؛ وهي ليست دليلاً ينطبق على كل نموذج حالي أو منتج أو نظام شخصيات خيالية.
يمكن للاختبار المركز لمحادثة الشخصية استخدام مجموعة صغيرة من المحادثات المجهزة مسبقًا:
قم بتقييم كل اختبار وفقًا للنطاق المقصود: الاسترجاع الصحيح، والاستبدال الصحيح للمعلومات القديمة، والفصل بين حقائق المشهد والحقائق العامة، والتعامل الصادق مع عدم اليقين. قم بتضمين الحالات التي تكون فيها الإجابة المتوقعة هي طلب التوضيح. إن النظام الذي يمتنع بثقة عن التخمين عندما تكون ملاحظاته المخزنة غامضة يتعامل مع تلك الحالة بشكل أفضل من نظام يختلق استمرارية وهمية.
مسار موثوق من التصحيح إلى الاسترجاع
يجب أن يتحرك التصحيح عبر مسار واضح: تحديد موضوعه، والحفاظ على نطاقه، وتحديث أي ذاكرة متضاربة، وإظهار التغيير المحفوظ، والتحقق من أن الردود اللاحقة تسترجعه دون توسيعه إلى تاريخ غير مدعوم. يمنح هذا التسلسل محادثة الشخصية طريقة عملية للبقاء متسقة عبر الأدوار والجلسات مع ترك التحكم في العالم الخيالي للمستخدم. تدعم الأبحاث أخذ تحديثات الذاكرة وتتبع الحالة على محمل الجد؛ ومسار العمل المحدد هنا هو توصية تصميمية، ويجب التحقق من سلوكها في المنتج الذي ستُستخدم فيه.
