Metlivi ब्लॉग

पारदर्शिता का मूल्यांकन रसीदों के माध्यम से करें, स्कोर से नहीं

एआई रिफ्लेक्शन कंपैनियन के लिए सबसे उपयोगी पारदर्शिता संकेतक वे हैं जिन्हें कोई व्यक्ति देख सकता है और उन पर कार्रवाई कर सकता है: एक स्थायी एआई पहचान और उत्पाद भूमिका; असमर्थित उपयोगों के साथ घोषित उद्देश्य; इस बातचीत में सक्रिय डेटा और मेमोरी का दायरा; किसी विशेष आउटपुट के पीछे के स्रोत, धारणाएं और अनिश्चितता; ऐसे नियंत्रण जो वास्तव में अनुभव को बदलते या रोकते हैं; स्थिति (स्टेटस) के साथ एक त्रुटि-रिपोर्ट और अपील पथ; और एक दृश्यमान संस्करण या अपडेट तिथि। इन्हें एक ट्रस्ट स्कोर में संकुचित न करें। इसके बजाय, प्रत्येक दावे के लिए चार कॉलम वाली एक साक्ष्य रसीद रखें: यह कहाँ दिखाई देता है, यह किस नियंत्रण को सक्षम बनाता है, यह किस नकारात्मक परीक्षण में सफल रहता है, और इसे पिछली बार कब जांचा गया था। यह उत्पाद के पारदर्शिता इंटरफ़ेस का मूल्यांकन करता है। यह किसी विशिष्ट उत्तर के बाहरी सत्यापन की जगह नहीं लेता है और न ही प्रतिस्पर्धी सेवाओं को रैंक करता है।

27 अगस्त 202611 मिनट का पठनसमय प्रबंधन और व्यक्तिगत विकासलेखक: Metlivi Editorial Team
खंड 1

एआई पहचान, उत्पाद भूमिका, उद्देश्य और सीमाओं से शुरुआत करें

अभिवादन, चरित्र का नाम या गर्मजोशी भरी आवाज़ पर्याप्त पहचान नहीं है। इंटरफ़ेस को यह स्पष्ट करना जारी रखना चाहिए कि व्यक्ति एक एआई-जनरेटेड सिस्टम के साथ बातचीत कर रहा है और उत्पाद की भूमिका का नाम देना चाहिए: उदाहरण के लिए, नोट्स व्यवस्थित करना, रिफ्लेक्शन प्रॉम्प्ट उत्पन्न करना, या विकल्पों का मसौदा तैयार करना। उद्देश्य को स्पष्ट असमर्थित उपयोगों और सीमाओं के पास रखें, केवल किसी दूरस्थ नीति में नहीं। पूछें कि यह प्रकटीकरण ऑनबोर्डिंग, एक सामान्य चैट, वॉयस मोड, एक साझा निर्यात (एक्सपोर्ट) के दौरान और लंबे समय बाद वापसी पर कहाँ दिखाई देता है। नकारात्मक परीक्षण एक भूमिका-बदलने वाला (रोल-स्विचिंग) प्रॉम्प्ट है: सहायक किसी काल्पनिक अभ्यास के लिए अपना लहजा बदल सकता है, लेकिन इसकी एआई पहचान और वास्तविक संचालक दृश्यमान रहना चाहिए। ईयू एआई अधिनियम का अनुच्छेद 50 लोगों को यह सूचित करने के लिए एक क्षेत्रीय डिज़ाइन संदर्भ प्रदान करता है जब वे कुछ एआई सिस्टम के साथ बातचीत करते हैं। प्रयोज्यता प्रासंगिक है, इसलिए इसे वैश्विक कानूनी निष्कर्ष के बजाय एक साक्ष्य स्रोत के रूप में उपयोग करें।

खंड 2

डेटा और मेमोरी के दायरे के लिए एक वर्तमान रसीद की मांग करें

एक प्राइवेसी लिंक यह नहीं दिखाता है कि किन इनपुट ने इस बातचीत को आकार दिया। उपयोग योग्य संकेतक सक्रिय दायरे को सूचीबद्ध करता है: वर्तमान संदेश, संलग्न फ़ाइल, प्रोफ़ाइल सेटिंग, प्रोजेक्ट संदर्भ, पिछली बातचीत, जुड़ा हुआ स्रोत, या याद रखी गई प्राथमिकता। यह इस आउटपुट के लिए उपयोग किए गए डेटा को किसी अन्य उद्देश्य के लिए एकत्र किए गए डेटा से अलग करता है और प्रत्येक आइटम को समीक्षा, सुधार, अक्षम करने या समाप्ति नियंत्रण से जोड़ता है। टेक्स्ट, वॉयस, नोटिफिकेशन, एक्सपोर्ट और लिंक किए गए डिवाइस में समान दायरा देखें। नकारात्मक परीक्षण एक मेमोरी सेटिंग को बदलता है, एक नई बातचीत शुरू करता है, और जांचता है कि प्रदर्शित दायरा और व्यवहार एक साथ अपडेट होते हैं या नहीं। यदि लेबल बदलता है लेकिन पुराना विवरण अभी भी दिखाई देता है, तो बेमेल (मिसमैच) रिकॉर्ड करें। यह अनुभाग स्टोरेज आर्किटेक्चर या विलोपन पूरा होने का ऑडिट नहीं करता है; अलग डेटा-पारदर्शिता गाइड उन कार्यों को संभालती है।

खंड 3

प्रत्येक महत्वपूर्ण आउटपुट को स्रोतों, धारणाओं और अज्ञात तथ्यों से जोड़ें

मॉडल गलत हो सकता है, ऐसा सामान्य कथन उस स्पष्टीकरण की तुलना में कमजोर होता है जो उस आउटपुट से जुड़ा हो जो मायने रखता है। रसीद को उपयोगकर्ता द्वारा प्रदान किए गए तथ्यों, तिथियों के साथ पुनर्प्राप्त स्रोतों, उत्पाद सेटिंग्स, सहायक के निष्कर्षों, अनसुलझे संघर्षों और उस जानकारी की पहचान करनी चाहिए जिसे सिस्टम एक्सेस नहीं कर सका। PAIR डेटा स्रोतों और सिस्टम के व्यवहार को इस तरह से समझाने की सलाह देता है जिससे लोगों को निर्भरता को कैलिब्रेट करने में मदद मिले। एक संख्यात्मक विश्वास मान (कॉन्फिडेंस वैल्यू) स्वतः उपयोगी नहीं होता: इसके लिए एक परिभाषित अर्थ, साक्ष्य और एक कार्रवाई की आवश्यकता होती है। किसी स्रोत को हटाकर, एक परस्पर विरोधी तथ्य प्रदान करके, और स्रोत तिथि के बाद किसी पुरानी प्रतिक्रिया को फिर से खोलकर परीक्षण करें। इंटरफ़ेस को समान निश्चितता बनाए रखने के बजाय अनिश्चितता को डाउनग्रेड या उजागर करना चाहिए। अंतर्निहित तथ्य का सत्यापन संबंधित तथ्य-जांच लेख में अलग वर्कफ़्लो बना रहता है।

खंड 4

परीक्षण करें कि क्या नियंत्रण व्यवहार बदलते हैं और एक स्पष्ट निकास प्रदान करते हैं

नियंत्रण तभी मायने रखते हैं जब उनका दायरा और प्रभाव अवलोकनीय हो। किसी व्यक्ति को याद रखी गई प्राथमिकता को संपादित करने, किसी सुविधा को बंद करने, वैयक्तिकरण को सीमित करने, सूचनाओं को रोकने, इंटरफ़ेस द्वारा वादा की गई चीज़ों को निर्यात करने और सहायक द्वारा संबंध दायित्वों का आविष्कार किए बिना बाहर निकलने में सक्षम होना चाहिए। प्रत्येक नियंत्रण के लिए, प्रभावित सतह, प्रभावी समय, पुष्टि और रोलबैक या पुनः प्रयास स्थिति नोट करें। PAIR यह समझाने की अनुशंसा करता है कि क्या फीडबैक बदलता है और कब, साथ ही एक ऑप्ट-आउट या रीसेट मार्ग को संरक्षित करता है। एक इनपुट स्रोत को अक्षम करके और किसी अन्य डिवाइस पर एक असंबंधित सत्र शुरू करके एक नकारात्मक परीक्षण चलाएं। यदि उत्पाद अभी भी उस स्रोत का उपयोग करता है, या यदि बाहर निकलने के लिए सामान्य खाता नियंत्रण के बजाय संवादात्मक बातचीत की आवश्यकता होती है, तो साक्ष्य रसीद खुली रहती है। एक मित्रवत पावती इस बात का प्रमाण नहीं है कि अंतर्निहित स्थिति बदल गई है।

खंड 5

त्रुटि रिपोर्टिंग, मानव समीक्षा, अपील और समापन स्थितियों का निरीक्षण करें

रिपोर्ट बटन समाधान (रिकोर्स) की केवल शुरुआत है। इंटरफ़ेस में यह बताया जाना चाहिए कि क्या रिपोर्ट किया जा सकता है, क्या साक्ष्य संलग्न हैं, क्या स्वचालित या मानव समीक्षा उपलब्ध है, स्थिति की जांच कैसे की जा सकती है, और कौन सी अंतिम स्थितियां मौजूद हैं: ठीक किया गया, अस्वीकार किया गया, पुनरुत्पादित करने में असमर्थ, अधिक्रमित (सुपरसीडेड), या अभी भी समीक्षाधीन। इसे किसी सामग्री सुधार को उत्पाद की घटना से अलग करना चाहिए और अनावश्यक प्रकटीकरण को बाध्य किए बिना संस्करण, बातचीत पहचानकर्ता और उपयोगकर्ता-दृश्यमान परिणाम को संरक्षित करना चाहिए। NIST कोर में पूरे जीवनचक्र में बाहरी फीडबैक और प्रलेखित प्रभाव कार्य शामिल हैं। एक हानिरहित पुनरुत्पादनीय बेमेल के साथ मार्ग का परीक्षण करें, फिर पावती, स्थिति परिवर्तन, स्पष्टीकरण और विवाद करने या जानकारी जोड़ने के तरीके की जांच करें। यह न समझें कि चुप्पी का अर्थ समाधान है, और जब तक कोई अंतिम स्थिति सामने न आए, तब तक समर्थन वादे को साक्ष्य के रूप में न गिनें।

खंड 6

प्रत्येक रसीद को संस्करण, तिथि, स्वामी और परिवर्तन इतिहास से बांधें

उत्पाद बदलने पर पारदर्शिता समाप्त हो जाती है। ऐप संस्करण, प्रकट किए जाने पर मॉडल या फीचर लेबल, नीति या सहायता-पृष्ठ तिथि, सक्रिय स्थान (लोकेल), डिवाइस सतह और नियंत्रण के लिए जिम्मेदार संगठन को रिकॉर्ड करें। फिर एक महत्वपूर्ण अपडेट के बाद परीक्षणों के एक छोटे सेट को दोहराएं: एआई पहचान, एक मेमोरी का दायरा, एक स्रोतों वाला आउटपुट, एक ऑप्ट-आउट, और एक रिपोर्ट स्थिति। NIST प्लेबुक स्वैच्छिक है और प्रासंगिक उपयोग के लिए डिज़ाइन की गई है, जो एक सामान्य चेकलिस्ट की नकल करने के बजाय वास्तविक कंपैनियन के लिए प्रासंगिक साक्ष्य चुनने का समर्थन करती है। एक रिलीज़ नोट जो कहता है "बेहतर अनुभव" व्यवहार परिवर्तन को मैप करने के लिए पर्याप्त नहीं है। उत्पाद को यह चिह्नित करना चाहिए कि क्या बदला, क्या बना रहा, और क्या पुरानी रसीदें अभी भी लागू हैं। ऐतिहासिक रसीदों को चुपचाप अधिलेखित (ओवरराइट) करने के बजाय उन्हें दिनांकित रखें।

खंड 7

सात-पंक्ति वाली रसीद का उपयोग रिलीज़ गेट के रूप में करें, कभी भी लीडरबोर्ड के रूप में नहीं

सात पंक्तियाँ बनाएं: एआई पहचान और भूमिका; उद्देश्य और सीमाएं; डेटा और मेमोरी का दायरा; स्रोत और अनिश्चितता; नियंत्रण और निकास; त्रुटि और अपील; संस्करण और तिथि। प्रत्येक पंक्ति के लिए दृश्यमान स्थान, सक्षम कार्रवाई, नकारात्मक परीक्षण, अवलोकित परिणाम, अनसुलझा अंतर, स्वामी और जांची गई तिथि को कैप्चर करें। रिलीज़ गेट किसी पंक्ति को केवल तभी पास करता है जब साक्ष्य मौजूद हों और कार्रवाई वर्णित अनुसार व्यवहार करती हो। यह अंक नहीं जोड़ता, असंबंधित कमियों का औसत नहीं निकालता, या सार्वजनिक रूप से उत्पादों की तुलना नहीं करता। बाहर निकलने के एक लापता मार्ग की भरपाई किसी अन्य स्थान पर दिए गए परिष्कृत स्पष्टीकरण द्वारा नहीं की जा सकती। अपडेट के बाद उसी कार्य पर रसीद की दोबारा जांच करें, और जहां साक्ष्य अनुपलब्ध हो वहां "अज्ञात" को सुरक्षित रखें। यह विधि पारदर्शिता को एक नारे से गलत साबित करने योग्य इंटरफ़ेस दावों के एक सेट में बदल देती है, बिना यह दिखावा किए कि केवल प्रकटीकरण ही समग्र गुणवत्ता या उपयुक्तता साबित करता है।

संबंधित प्रश्न

सामान्य प्रश्न

क्या पारदर्शिता एक ही स्कोर बन जानी चाहिए?

नहीं। एक समग्र (कम्पोजिट) स्कोर असंबंधित प्रकटीकरणों के पीछे किसी लापता निकास या अपील मार्ग को छिपा सकता है; प्रत्येक साक्ष्य पंक्ति को अलग रखें।

क्या एक विस्तृत गोपनीयता नीति पर्याप्त है?

नहीं। वर्तमान बातचीत को सक्रिय इनपुट, मेमोरी, स्रोतों, अनिश्चितता और नियंत्रणों के लिए दृश्यमान, कार्रवाई योग्य संकेतकों की भी आवश्यकता होती है।

रसीद की कितनी बार जांच की जानी चाहिए?

पहले उपयोग पर और सार्थक मॉडल, सुविधा, नीति, मेमोरी या खाता-नियंत्रण परिवर्तनों के बाद इसकी जांच करें।

संबंधित लेख

इस विषय को आगे पढ़ें