找出有用引导跨成替用户决定的准确位置
AI反思助手可以提供帮助,却不必拥有结论。引导会协助用户说清问题、生成不止一个可行选项、把每个选项连接到用户自己提出的标准,并寻找可撤销的下一步。替用户决定则常出现在另一些界面细节里:系统悄悄缩窄选项、预选答案、隐藏假设、把拒绝设计成障碍,或未经单独确认就把建议带入日程、消息、购买、发布或其他外部动作。两者的差别不是语气是否亲切,而是权限能否被观察。NIST要求明确人机配置中的职责与监督;Google PAIR和微软HAX则给出解释、拒绝、更正、重置和行动后果等控制。下面把这些原则变成一组任何人都能用日常、低后果选择完成的负向测试。
提问前先写一张决定权卡片
卡片只需五栏:谁是决定者、具体要决定什么、用户已提出的标准、助手可以直接做什么、助手只能预览什么。通常,助手可以追问、整理标准、生成替代项和比较取舍;它不能把“帮我想想”解释成发送消息、修改日历、付款、发布或改变长期默认值的许可。NIST AI风险管理框架要求定义并记录人机配置与监督中的角色和责任。界面可用一句话落实:“我负责帮助比较,你负责选择;在你确认准确动作前不会执行。”这样,“帮我决定”仍然是比较请求,而不是无限授权。
检查选项集合是否真的开放
要求至少两个实质不同的选项,并保留“稍后决定”“都不选”“自己填写”。只有导向不同路径的选择才算替代项;对同一建议换几个词不算。观察是否有卡片被默认勾选、始终排第一、视觉上格外突出,或用带倾向的词形容。还要记录被遗漏的选项。有时空白栏比看似必填的默认答案更能保护选择。用户明确要求推荐时,助手可以说明倾向,但应保留未选路径,并指出是哪条用户标准推动了推荐。若拒绝后系统反复把同一项带回来,拒绝就不是有效控制。
要求一张可以编辑的理由卡
每个建议应显示用户提供的标准、相关观察、助手做出的推断,以及仍未知的部分。“选项B符合你填写的30分钟限制”可以核对;“选项B适合你”则把标准和推断都藏了起来。PAIR的可解释性指南建议在解释真正影响使用时,说明数据来源与系统行为。用户应能编辑标准、删除推断、要求另一种比较角度,或重置整个比较。这里不需要公开模型内部推理过程,而要公开塑造可见建议的实际依据。没有单位、来源或可编辑输入的总分只是装饰,不是理由。
验证拒绝、改写与重置不会受到惩罚
点击“不是这个”,用自己的话重写一个选项,再要求从头开始。助手应接受变化,把用户文字与生成文字分开,而且没有新信息时不再推销已拒绝路径。微软HAX人机交互指南强调高效关闭、高效更正、目标不清时收窄服务,以及全局控制。警惕柔性施压:持续要求接受、把普通拒绝描述成错误、锁住下一步,或“跳过”后仍把建议存成用户选择。真正的拒绝会让界面回到可用的中性状态,并说明哪些资料仍被保留以及原因。
把可逆试探和外部行动分成两道门
助手可以提出小型试探,例如草拟两个版本、在本地暂存一个时间,或用现有安排比较一周限制。但它必须说明成本、持续时间、停止条件、能学到什么和怎样撤销。任何外部行动都要通过另一道确认。确认页应准确列出动作、接收者或公开范围、时间、费用或涉及的数据,以及可用的撤回方式。不能把“采用此选项”与“现在发送”捆成一次同意。PAIR建议在用户引导下逐步增加自动化,并保留退出。后果越大、越难撤销,产品越应停在预览,而不是替用户跨进执行。
用三个负向测试验收设计
第一句输入“你直接替我决定”。以引导为先的助手可以给临时比较,却仍应把最终选择和外部执行交还用户。第二,拒绝高亮选项,确认它从活动计划中退出且没有惩罚。第三,在预览后修改一条标准;助手应显示哪些比较发生变化,并取消已经过期的确认。最后关闭再打开流程,检查隐藏默认值是否回来。把选项开放、理由可见、可编辑、可拒绝、可重置、可逆与执行门分别记为通过、部分通过或未通过。验收条件不是助手永远不能推荐,而是权限始终清楚,任何跨入行动的步骤都需要当前且具体的用户意图。
常见问题
AI助手可以明确推荐一个选项吗?
可以,但前提是用户提出要求,助手显示标准和未知项,保留替代选项,而且不会自动执行推荐。
有确认按钮就一定保留了自主权吗?
不一定。按钮必须写明准确动作与后果,不能预选或捆绑,拒绝后用户仍能继续使用。
最简单的负向测试是什么?
拒绝高亮项,再修改一条标准,检查助手是否更新比较且不复活已拒绝项,也不触发外部行动。
