하나의 관찰이 반복 꼬리표가 되는 경로를 추적하세요
AI 컴패니언은 노골적으로 부정적인 문장을 쓰지 않고도 좁은 순환을 만들 수 있습니다. 사용자가 이번 주 초대 두 건을 거절하자 ‘혼자를 선호한다’고 저장하고, 모임 제안을 줄인 뒤, 줄어든 선택지 안에서 조용한 활동을 고른 결과를 원래 추론의 근거로 삼는 식입니다. 필요한 것은 편향을 전부 없앴다는 선언이 아닙니다. 관찰과 추론을 분리하고, 출처와 유효기간을 남기며, 어느 화면에 영향을 주는지 보여 주고, 사용자가 편집·중단·초기화할 수 있어야 합니다. 아래 감사에서는 입력이 기억, 요약, 추천과 알림으로 이동하는 길을 그린 다음 수정이 각 표면에서 실제로 작동했는지 확인합니다.
문구를 다듬기 전에 네 단계 꼬리표 루프를 그리세요
관찰 가능한 사건, 시스템 추론, 저장 상태, 하위 화면 네 칸을 만듭니다. ‘이번 주 초대 두 건을 거절함’은 날짜와 상황이 있는 사건입니다. ‘오늘 저녁은 조용한 선택을 원할 수 있음’은 임시 추론입니다. 반면 ‘사교적이지 않음’은 제한된 자료에서 만든 지속적 성격 꼬리표가 됩니다. 기억, 프로필 요약, 프롬프트 조립, 추천, 알림, 검색 순서와 내보내기 중 상태가 어디에 쓰이는지 모두 적으세요. NIST 생성형 AI 프로필은 유해한 편향과 동질화를 문서화된 측정과 시험이 필요한 위험으로 봅니다. 따라서 감사 단위는 첫 답변 한 문장이 아니라, 그 문장이 반복되는 제품 행동으로 바뀌는 전체 경로입니다. 트랜스크립트만 읽으면 추천에서 좁아진 선택 폭을 놓칠 수 있습니다.
관찰에는 시간, 맥락, 출처와 만료를 붙이세요
다른 사람도 확인할 수 있는 문장을 씁니다. ‘화요일에 조용한 옵션을 선택함’이나 ‘이 제안을 한 번 닫음’처럼 행동까지만 기록하고 성격, 동기나 능력을 더하지 않습니다. 출처는 사용자의 명시적 발언, 관찰한 행동, 제품 추론, 사용자가 확인한 선호 중 하나로 표시합니다. 세션 선택은 세션이 끝날 때, 여행을 위해 확인한 선호는 여행 뒤에 만료하도록 맥락에 맞는 기한을 둡니다. NIST는 AI 편향을 데이터뿐 아니라 사람의 결정과 배치 환경을 포함하는 사회기술적 문제로 설명합니다. 출처가 사라진 중립 필드가 다른 상황에서 재사용되면 원래보다 강한 의미를 띨 수 있으므로 무엇을 봤고 어디까지 말할 수 있는지 함께 보관해야 합니다.
클릭과 침묵을 찬성표로 저장하지 마세요
클릭, 긴 멈춤, 닫기, 반복 선택에는 여러 이유가 있습니다. 사용자가 탐색 중이거나 시간이 부족하거나 반복을 피했거나, 애초에 다른 옵션을 보지 못했을 수 있습니다. Google PAIR는 암묵 피드백이 모호하고 하나의 상호작용이 반드시 ‘더 보여 달라’는 뜻은 아니라고 설명합니다. 이런 신호는 관찰로 남기고 지속적인 개인화를 바꾸려면 명시적 선호, 실제로 다양한 선택지에서 반복된 행동, 또는 거절 가능한 확인을 요구하세요. 선택 집합도 함께 검사합니다. 시스템이 모임 옵션을 먼저 제거했다면 이후의 조용한 선택은 처음 꼬리표를 독립적으로 확인하는 증거가 아닙니다. 시스템이 만든 좁은 환경을 사용자 특성으로 다시 읽지 않아야 합니다.
수정에 상태, 범위와 전파 결과를 부여하세요
추론 옆에 ‘나와 맞지 않음’, ‘오늘만’, ‘편집’, ‘앞으로 사용하지 않기’, ‘초기화’를 제공합니다. 수정은 요청됨, 적용됨, 일부 적용, 미적용 같은 상태를 가져야 합니다. 범위도 이 대화, 향후 추천, 저장 프로필, 요약, 알림과 연결 기기로 나눕니다. PAIR는 적응형 시스템에 쓰이는 정보를 사용자가 확인·편집·초기화하고 효과가 나타나는 시점과 범위를 이해할 수 있어야 한다고 권합니다. 캐시나 공유 사본이 다른 절차를 따른다면 모든 곳에서 즉시 사라졌다고 쓰지 마세요. 변경된 곳, 남은 곳, 이유와 다음 확인 시점을 보여 주세요. 거절된 꼬리표를 수정 기록 본문에 그대로 보관해 새로운 추론 재료로 쓰지 않는 것도 중요합니다.
여러 관점 설명과 반사실 시험을 함께 사용하세요
같은 중립 관찰에 대해 어느 것도 사실로 단정하지 않고 최소 두 가지 맥락 설명을 적습니다. 초대를 거절한 일은 시간, 이동 거리, 그날 일정이나 일시적 선택으로 설명될 수 있으므로 컴패니언은 성격 꼬리표를 고르기보다 질문하거나 불확실한 상태를 유지합니다. 별도의 무해한 시험 계정에서는 요청과 관찰을 같게 두고, 과제와 관련 없는 정체성 단서 하나만 바꿉니다. 바꾼 정보가 실제로 필요하지 않다면 제안 범위, 말투와 기억 규칙이 실질적으로 같아야 합니다. NIST는 편향 위험 평가에 반사실 입력과 낮은 맥락 시험을 포함합니다. 실제 사람을 프로파일링하지 말고 평범한 합성 예시로 대화, 추천, 요약과 알림을 비교하세요.
꼬리표가 숨은 것이 아니라 루프가 끊겼는지 확인하세요
무해한 시험 계정에 기한이 있는 선호를 입력하고 영향을 받은 화면을 적은 뒤 수정하거나 철회합니다. 다른 기기에서 앱을 다시 열고 새 추천을 요청하고, 보이는 프로필이나 내보내기도 확인하세요. 결과는 관찰 유지, 임시 추론, 사용자 확인 선호, 수정·철회, 미해결 다섯 상태로 기록합니다. OECD의 인간 중심 공정성 원칙은 맥락에 맞는 보호 장치, 투명성과 사람의 감독을 강조합니다. 실무 합격 기준은 구체적입니다. 출처 유형을 설명할 수 있고, 수정이 선언한 범위에 도달하며, 새로운 근거 없이 거절된 꼬리표를 다시 만들지 않아야 합니다. 이는 강화 가능성을 낮추면서 불확실성을 정직하게 남기는 시험이지, 시스템 전체가 편향에서 자유롭다는 인증이 아닙니다.
자주 묻는 질문
AI 컴패니언은 내가 말한 모든 선호를 기억해야 하나요?
아닙니다. 일시적 선택과 지속 선호를 구별하고 저장 기간과 편집·초기화 수단을 보여 줘야 합니다.
클릭은 선호를 보여 주는 확실한 증거인가요?
단독으로는 아닙니다. 특히 선택지가 이미 좁았다면 클릭에는 여러 가능한 설명이 있습니다.
수정이 반영됐는지 어떻게 확인하나요?
새 대화, 추천, 프로필이나 기억 보기, 알림과 다른 기기를 선언한 범위에 맞춰 확인하고 이전 추론이 남은 화면을 기록합니다.
