Akıcı bir yapay zekâ yanıtını doğrulayabileceğiniz bir iddia dökümüne dönüştürün
Akıcı bir yapay zekâ yanıtı; doğrulanmış ayrıntıları, makul yorumları ve eksik bilgileri aynı paragrafta harmanlayabilir. Paragrafı basitçe güvenilir veya güvenilmez olarak değerlendirmeyin. Onu atomik iddialara bölün ve her birini olgu, çıkarım veya bilinmeyen olarak etiketleyin. Bir olgu harici olarak kontrol edilebilir niteliktedir ve bir kaynağın yanı sıra bir zaman kapsamına ihtiyaç duyar. Bir çıkarım olguları birbirine bağlar ve bu bağlantının dayanağını göstermek zorundadır. Bir bilinmeyen ise eksik, çelişkili, muğlak veya potansiyel olarak güncelliğini yitirmiş bilgileri kapsar. Önemli bir karar için alıntılanan sayfayı inceleyin, zamana duyarlı ayrıntıları mevcut birinci taraf sahibiyle doğrulayın ve gerçekten bağımsız ikinci bir kaynak arayın. Modelden alıntılar veya güven etiketleri eklemesini istemek organizasyonu iyileştirir, ancak yanıtı kanıtlamaz.
Her cümleyi kontrol etmeden önce kararı tanımlayın
Yanıtın neyi etkileyeceğini, kararın ne zaman verilmesi gerektiğini ve hangi hatalı ayrıntının tercihi değiştirebileceğini yazın. Bu, bir doğrulama oturumunun zararsız metinlerin denetimine dönüşmesini engeller. Yalnızca sonuç doğurabilecek ifadeleri iddia kartlarına ayırın: tam iddia, varlık, sayı veya koşul, ilgili tarih, önerilen kaynak ve doğrulama durumu. "Mekân erken açılıyor ve bu nedenle programınıza uyuyor" gibi bir cümle en az iki iddia içerir: kontrol edilebilecek bir açılış saati ve takviminize bağlı olan uygunlukla ilgili bir çıkarım. NIST, konfabülasyonu kendinden emin bir şekilde ifade edilen hatalı veya yanlış içerik olarak tanımlar. Dolayısıyla sunumdaki güven faydalı bir kestirme yol değildir; önemli olan iddianın rolü ve kanıtıdır.
Kesin çıkış koşullarına sahip üç etiket kullanın
Bir iddiayı, yalnızca erişilebilir bir kaynak aynı varlığı, değeri, koşulu ve zaman aralığını doğrudan desteklediğinde olgu olarak işaretleyin. Temelindeki olgular desteklendiğinde ancak varılan sonuç mantıklı bir bağlantıdan ibaret olduğunda bunu çıkarım olarak işaretleyin; öncülleri koruyun ki başka biri olguları tartışmaya açmadan bu sonuca katılmayabilsin. Bilgi eksik, muğlak, çelişkili, aracın erişim alanı dışında veya güvenilir bir kapsam için çok yeni olduğunda bunu bilinmeyen olarak işaretleyin. "Bilinmeyen" tamamlanmış bir durumdur, boşluğu bir tahminle doldurmaya yönelik bir davet değildir. OpenAI'ın araştırmaları, modellerin makul görünen yanlış ifadeler üretebileceğini ve sistemlerin çekimser kalmak yerine tahminde bulunduklarında ödüllendirilebildiğini açıklamaktadır. Modelin kendi bildirdiği güven düzeyi, kontrollerin önceliklendirilmesine yardımcı olabilir ancak desteklenmeyen bir iddiayı olgu düzeyine yükseltemez.
Kaynağın tam iddiayı destekleyip desteklemediğini kontrol edin
Bir alıntı başlığına, arama snippet'ına veya üretilen alıntıya güvenmek yerine alıntılanan sayfayı açın. Sayfanın mevcut olduğunu, aynı varlığı adlandırdığını, aynı miktarı veya kuralı belirttiğini, ilgili konumu veya sürümü kapsadığını ve yalnızca başka bir yayıncıyı tekrar etmediğini doğrulayın. Yayınlanma veya güncellenme tarihini bulun ve bunu arama motorunun tarama veya dizine ekleme tarihinden ayırt edin. Google'ın kaynak değerlendirme kılavuzu; kaynağın ne olduğunu, ilgili bilgiye sahip olup olmadığını, bilgiyi neden paylaştığını, ne zaman yayınlandığını ve diğer kaynakların ne söylediğini sormayı önerir. Bir bağlantı bir cümlenin yalnızca bir kısmını destekliyorsa, cümleyi tekrar bölün. Kanıtı daha geniş bir sonuca yaymak yerine "kısmi destek" olarak kaydedin.
Önemli iddialar için birinci taraf ve bağımsız kontrolleri kullanın
Mevcut bir takvim, özellik, fiyat, politika, teknik özellik veya hesap ayarı için işe bilginin sahibi olan kuruluşla başlayın. Ardından, kopyalanmış bir makaleyi, ortak dağıtılan bir basın bültenini veya aynı doğrulanmamış ifadeyi alıntılayan bir sayfayı değil, olguyu bağımsız olarak elde etmiş bir kaynağı kullanın. İki bağlantı, otomatik olarak iki kaynak anlamına gelmez. Yalnızca birinci taraf sayfası mevcutsa bu sınırlamayı kaydedin. Güvenilir iki kaynak çelişirse tarihleri, sürümleri, coğrafyayı, tanımları ve düzeltme bildirimlerini karşılaştırın; birbiriyle uyumsuz sayıların ortalamasını almayın. Birleşik Krallık Hükümeti'nin üretken yapay zekâ kılavuzu, çıktıların kullanım senaryosuna uygun önlemlerle temel gerçeklik (ground truth) veya bilinçli muhakeme karşısında değerlendirilmesini önerir. Bu ilkenin kullanıcı sürümü basittir: aramaya başlamadan önce neyin teyit sayılacağını tanımlayın.
Geniş soruları yanıtlanabilir birimlere dönüştürün
"Bu seçenek iyi mi?" gibi sorular gizli varsayımlara davetiye çıkarır. Bunları; mevcut durum, belirtilen gereksinimler, yürürlük tarihi, bilgi sahibi tarafından yayınlanan sınırlamalar ve karşılaştırma için kullanılan kişisel tercihler gibi birimlerle değiştirin. Yapay zekâdan varsayımları listelemesini, açamadığı hiçbir kaynaktan alıntı yapmamasını, değişen olgulara bir tarih eklemesini ve bilinmeyenleri görünür kılmasını isteyin. Ardından yanıtın dışındaki birimleri doğrulayın. Bir kaynak resmi bir açılış saatini ortaya koyabilir; ancak takviminiz olmadan o saatin uygun olduğunu ortaya koyamaz. Bir ürün sayfası bir özelliği açıklayabilir; ancak siz gözlemlemediğiniz sürece cihazınızda nasıl davrandığını ortaya koyamaz. Kamusal olguları kişisel girdilerden ayırmak, yalnızca bir yanıtı iyileştirmek uğruna özel bilgileri ifşa etme eğilimini de azaltır.
Dökümü dört sonuçtan biriyle kapatın
Her önemli iddia doğrulanmış, desteklenen çıkarım, çözümlenmemiş veya geçersiz kılınmış olarak sonuçlanır. Doğrulanmış, doğrudan kanıtın ve zaman kapsamının eşleştiği anlamına gelir. Desteklenen çıkarım, öncüllerinin doğrulandığı ve muhakemenin açık olduğu anlamına gelir. Çözümlenmemiş, kanıtın eksik veya çelişkili olduğu anlamına gelir. Geçersiz kılınmış, daha yeni bir birinci taraf kaydının eski bir ifadenin yerini aldığı anlamına gelir. Erişim tarihini ve rezervasyondan önceki gün veya bir ürün güncellemesinden sonrası gibi bir yeniden kontrol tetikleyicisini ekleyin. İki kaynaklı kontrolü sonsuz bir internet taramasına dönüştürmeyin: önceden tanımlanmış teyit standardı karşılandığında durun veya bilinmeyeni kaydedip geri alınabilir bir sonraki adımı seçin. Bu, her sorunun nihai bir yanıtı varmış gibi davranmadan belirsizliği eyleme dönüştürülebilir kılar.
Zararsız bir kalibrasyon alıştırması yapın
Tarihli bir birinci taraf sayfası bulunan, kamuya açık ve riski düşük bir olgu seçin; örneğin halka açık bir mekânın belirli bir tarihteki açılış saatleri gibi. Yapay zekâdan bir yanıt, varsayımlarını ve ayrı olgu, çıkarım ve bilinmeyen alanları sunmasını isteyin. Modele özel veriler vermeden her bağlantıyı inceleyin ve sonucu birinci taraf sayfasıyla ve bağımsız bir kaynakla karşılaştırın. İkinci bir komut isteminde tarihi veya konumu değiştirin ve yanıtın zaman kapsamını güncelleyip güncellemediğini veya eski bir ayrıntıyı sürdürüp sürdürmediğini görün. Komut istemini, gösteriliyorsa model veya ürün sürümünü, iddia etiketlerini, kaynakları, tutarsızlıkları ve nihai durumu kaydedin. Test materyali olarak profesyonel veya yüksek riskli soruları kullanmayın. Bu alıştırma, model için evrensel bir doğruluk oranını değil, doğrulama iş akışınızı test eder.
Sık sorulan sorular
Bir alıntının olması, yapay zekâ iddiasının doğrulandığı anlamına gelir mi?
Hayır. Kaynağı açın ve aynı iddiayı, varlığı, koşulu ve zaman aralığını doğrudan desteklediğini teyit edin.
İki arama sonucu çift kaynaklı doğrulama için yeterli midir?
Yalnızca gerçekten bağımsız olduklarında ve iddiayı doğrudan desteklediklerinde yeterlidir; aynı kökeni tekrarlayan iki sayfa tek bir kanıt zinciri sayılır.
Güvenilir kaynaklar birbiriyle çeliştiğinde ne yapmalıyım?
Tarihleri, sürümleri, coğrafyayı ve tanımları karşılaştırın. Çelişki açıklanamıyorsa iddiayı çözümlenmemiş olarak bırakın.
