读懂 Human or Not 聊天猜谜游戏
Human or Not?是一款简短的猜谜游戏:匿名聊天两分钟,然后判断对方是真人还是 AI 机器人。核心在于享受交流过程并做出推测,而非去证明某人的真实身份。目前的运营方提醒,聊天内容可能会被公开分享并可能用于训练 AI 模型,因此请勿在对话中透露个人详细信息。以下是每局游戏的进行方式、结果代表的含义,以及如何在合理的隐私边界内畅玩。
一局游戏中会发生什么?
当前的 Human or Not?常见问题解答(FAQ)将该游戏描述为与真实玩家或 AI 机器人进行的历时两分钟的聊天。对方同样也在试图辨别你的身份。倒计时结束时,你需要猜测你的聊天对象究竟是真人还是 AI。
FAQ 中提到,人类搭档是来自世界各地的真实玩家。目前列出的驱动机器人的大型语言模型包括 GPT-5、Claude 和 Google Gemini Flash。这些是运营方针对当前游戏提供的细节说明;它们并不代表所有的 AI 模型或每一局游戏,且 FAQ 也未承诺每个模型都会出现在每次会话中。
进行对局的一个实用方法,是将其视作与未知搭档的一次简短交流。问一些轻松的话题,给对方留出回应空间,顺着对方的话继续聊,并留意对话的展开方式。你可以根据整个交流过程做出推测,但完全没必要将其变成一场审讯,或是通过透露个人经历来试探对方。
你最终的猜测意味着什么?
你的结果会告诉你,你的猜测是否与游戏在该局中的隐藏设定相匹配。一次猜对或猜错,并不能成为在其他场景中识别真人或 AI 的可靠方法。简短的文字对话能提供的线索十分有限:真人写起东西来可能异常工整或模板化,而 AI 也可能给出极其自然的回复。某个单一的对话特征可能会指向截然相反的结论。
运营方的 FAQ 建议提出一些不走寻常路的问题,并指出机器人可能在谈论近期事件或极其个人化的经历时显得吃力。但请把这当作游戏建议,而非某种可靠的识别测试。一段显得模糊、流畅、有错或具体的回答并不能作为身份证明。对方可能只是误解了意思、选择不分享,或者纯粹只是表达方式与你预想的不同而已。
最初的研究发现了什么
这款游戏的名字同样源自一个早期的研究项目。在 2023 年 5 月 31 日提交至 arXiv 的一篇论文中,Daniel Jannai 及其合著者描述了一项更早的网络实验。在为期一个月的时间里,超过 150 万名用户参与了匿名两分钟聊天,对手可能是真人,也可能是被提示模仿人类行为的 AI 语言模型。随后玩家需要猜测自己遇到了哪一种。
在那项研究中,参与者在所有游戏中的整体猜测准确率为 68%,在面对 AI 时的准确率为 60%。这些只是该特定实验及其设定下的结果,并不是对如今运营方游戏的衡量指标,也不是你在自己的对局中应当期望达到的准确率。arXiv 上的原始论文将这些发现作为实验呈现,并呼吁进行进一步的拓展和完善。其历史研究结果有助于解释该游戏的研究渊源;它们并不能充当通用的 AI 检测器认证。
如何保持对局的私密与舒适
当前的 FAQ 给出了明确的隐私警告:网站上的信息是公开的,聊天记录可能会被其他用户在线分享或发布在排行榜上,且聊天数据可能用于训练 AI 模型。它还引导访客查阅网站的隐私政策、服务条款和 Cookie 政策。由于存在被分享的可能,请假定你输入的任何内容都可能在这次直接对话之外被他人看到。
在开始之前,请把握以下简单的界限:
请注意,可识别个人身份的细节可能是多项信息的组合(例如学校、工作单位、社区和日程安排),而不仅仅是姓名。- 切勿在聊天中透露联系方式、密码、财务信息、私人照片以及账号或安全验证码。- 同样避免分享他人的个人信息。- 如果对话让人感到不适,请直接停止互动,而不必勉强完成该局游戏。- 如果你想进一步了解数据处理详情,请查看运营方最新的隐私和服务条款页面。
这些防范措施均遵循了运营方自身关于公开分享和数据使用的披露说明。它们还能让游戏回归其本质:一项简短、有趣的小挑战,而非私密聊天渠道。
做出推测的简单方法
在两分钟结束时,稍作停顿,问问自己究竟是什么促成了你的选择。对方是否接住了对话的思路?他们是否应对了一个出其不意但无伤大雅的问题?整个交流过程总体上是否连贯?这些都只是观察,而不是身份测试。它们能帮助你做出深思熟虑的游戏猜测,而无需依赖关于人类或机器“应该”如何写作的刻板印象。
如果你拿不准,这也是完全正常的结果。游戏要求你做出选择,但在信息有限的简短接触中,不确定性本就是其中一部分。做出猜测,查看揭晓的答案,并将结果仅仅视作该局游戏的反馈——而不是对那个人的定论,不是对你智力的测试,更不是用于在其他地方对待陌生人的法则。
Human or Not?是一场真正的图灵测试吗?
当前的 FAQ 将 Human or Not?描述为一款社交图灵测试游戏,并对图灵测试做出了简要解释:评估机器能否展现出与人类无法区分的智能行为。在实践中,这款两分钟的游戏是由该理念启发而来的趣味性、受限体验。它并非对智力、意识或身份的综合评估。
实用的建议非常简单明了:聊聊天、享受挑战、做个初步推测,并保护好你的隐私。2023 年最初的实验提供了有趣的历史背景,而运营方的 FAQ 则阐述了当下的游戏及其当前的披露说明。两者都无法让一场两分钟的对话成为确定另一端到底是谁——或是什么——的可靠方法。
参考来源
来源与范围
所引用的来源用于支持当前的产品描述和限定性声明。界面细节、方案和可用性可能会发生变化;做出购买或安装决策时请查看最新的官方页面。文中的编辑示例仅供说明之用,不承诺特定结果。
