在游戏原型中,AI 对白应该主导、辅助还是隐于幕后?
如果你是一名正在为可玩原型选择 AI 对白定位的独立设计师,请从玩家的任务入手:有哪些他们应该能做到、但预设台词无法很好支持的事情?只有当与角色即兴互动本身就是玩法时,才让 AI 成为核心交互。当固定的玩法和故事仍然占据主导地位时,将其用作辅助层。当玩家根本不需要生成式对话时,将其作为创作者工具留在幕后。每种选择都会改变玩家能做的事、系统失效时的表现,以及团队必须承担的工作量。
从玩家任务开始
“AI 对白”可以指两件截然不同的事情:在玩家与角色互动时生成的对白,以及创作者用来起草草稿以便后续挑选和编辑的 AI。此外还有一个折中选择:一款大部分为预设内容的游戏,在有限的辅助场景中使用生成对白。这些是不同的设计决策,而不是每款游戏都必须逐级攀登的三个阶梯。
育碧的 [NEO NPC 原型](https://news.ubisoft.com/en-us/article/5qXdxhshJBXoanFZApdG3L/how-ubisofts-new-generative-ai-prototype-changes-the-narrative-for-npcs) 探索了面向玩家的自由形式对话,其中的角色由编剧塑造,并受到情境和角色设定的约束。育碧将 NEO NPC 描述为一个原型,并不代表这种方法在每款发行的游戏中都行得通。相比之下,[Ghostwriter](https://news.ubisoft.com/en-gb/article/7Cm07zbBGy4Xml6WgYi25d/the-convergence-of-ai-and-creativity-introducing-ghostwriter) 为编剧生成各种环境喊话(barks)草稿,供其挑选和润色。其目标用户是编剧;生成的文本并不会作为实时的玩家对话呈现。
第三个设计参考则是完全预设的。在 [Strange Scaffold 对《阳光洗牌》(*Sunshine Shuffle*)的复盘](https://www.gamedeveloper.com/design/deep-dive-creating-seamless-dialogue-for-sunshine-shuffle) 中,设计师 Stav Hinenzon 描述了如何围绕扑克牌玩法组织台词、简短喊话以及更长的叙事片段,并借助优先级和时机规则来控制哪些内容占据焦点。该游戏的对白系统在不需要生成文本的情况下支撑了整个体验。综合来看,这些案例提出了一个实际的原型问题:玩家是需要与角色即兴互动,还是游戏需要围绕预设内容提供一个响应层,亦或是团队主要需要协助产出草稿?
三种定位的对比
**核心交互**:在自由形式的对话中提问或发言,通过角色达成目标。玩家的输入会改变哪些有用信息、行动或关系状态变得可用。追踪任务完成情况以及回应是否正确支持了下一个预期的行动。为角色设定明确的支持话题和状态变更范围;对于不支持的输入,使用预设的转移话题台词或返回到已知的对话状态。成本最高。团队必须界定角色和情境约束,将对白与游戏状态关联,处理非预期输入,并测试远多于固定剧本的对话交互分支。
**辅助层**:进行核心游戏,同时对白会对特定事件做出反应或提供可选回复。某句台词可以澄清、丰富氛围或响应某个事件,而不会阻碍核心操作。追踪玩家是否注意到相关台词,以及他们是否无需等待即可继续任务。保持主线路径和关键信息为预设撰写。如果生成不可用或不合适,则使用固定台词、安静的回应或不触发台词。中等至偏高。团队必须协调生成内容与预设节拍、时机、角色口吻以及可能触发它的游戏状态。
**创作者工具**:游玩预设的游戏;编剧或设计师在制作期间使用 AI 起草各种变体。玩家体验到的是经过挑选和编辑的内容。制作上的衡量标准是该工具是否有助于团队针对特定编写任务产出可用选项。编剧批准的剧本即为回退方案和最终的游戏内内容。成本各异,但没有运行时的实时对白系统需要维护。成本转移到了工具配置、审查、筛选、编辑以及将流程融入写作工作之中。
这些结果是需要测试的设计目标,而非必然的效果。只衡量对原型任务至关重要的指标。一段对话可能很流畅,但如果没有提供可付诸行动的信息,它依然是失败的;一句生成的即兴喊话可能很有魅力,但如果打断了玩家必须进行的行动回合,同样是不合格的。
当即兴发挥就是核心机制时,选择“核心交互”
当游戏的核心承诺依赖于玩家表达出设计师无法在事前轻易穷举的想法,且角色的回应能够切实影响玩家接下来的行动时,采用面向玩家的自由对白。在构建模型之前,先明确何为成功的交互:也许是玩家获得了线索,促使 NPC 执行了几种有效行动之一,或者通过特定的质问策略了解了某项事实。
为原型的世界划定界限。界定角色知道什么、不会做什么、能够改变哪些游戏状态,以及当提示词无关时会发生什么。育碧对 NEO NPC 的描述强调了编剧创建的角色背景和行为引导,以及在模型偏离预期角色设定时进行迭代。这指向了一项实际的制作任务:创作者仍然需要判断每一次回应是否符合角色和情境。除非你已经明确设计并测试了该路径,否则切勿让即兴发挥的文本悄然变成新的剧情事实或游戏状态指令。
一种实用的回退方案是预设好并显式体现在设计中:当输入超出支持的任务范围时,角色可以提出澄清性问题,解释自己能帮上什么忙,或者将玩家引回已知选项。如果原型无法可靠地保证目标推进,请确保关键信息可以通过固定对白或其他预设路径获取。
当预设节拍主导游戏时,选择“辅助层”
辅助层可以在核心交互保持可预测的同时,对游戏事件做出反应。这可能意味着可选的环境闲聊、对少数特定动作的简短回应,或者是围绕固定叙事节拍生成的变体台词。设定边界:哪些事件可以触发台词、台词是否可以打断当前操作,以及其内容是否允许引入新信息。
《阳光洗牌》提供了一个很有参考价值的预设对白范例:它的对白单元、优先级和触发时机都是围绕扑克牌的回合节奏和故事节奏来设计的。开发者的分享提到,台词需要留给玩家足够的阅读时间,并且玩家的输入会推进叙事片段中的台词。这对辅助型 AI 层的启示十分明确:响应机制必须契合玩法的节奏。一句在做决策时蹦出的台词,哪怕措辞再好,也可能会干扰游戏体验。
对于指示、线索、决策以及任何时机至关重要的叙事节拍,请务必保留预设文本。对于可选的反应,定义一种静默的失败模式:跳过该台词、使用固定替代文本,或推迟到玩法允许时再触发。测试在关闭生成层的情况下,玩家是否仍能完成核心任务。
当玩家不需要生成式对话时,选择“创作者工具”
如果你需要的是更多的文本素材——尤其是大量短小的变体台词——请先尝试创作者工具定位。育碧将 Ghostwriter 描述为能够提出喊话草稿供编剧挑选和润色,并将人工反馈内嵌在流程中。这是一种制作工作流,而非直接面向玩家的 NPC 交互。让审核通过的台词始终处于编剧掌控之下,并针对真实、有边界的草拟任务来测试该工具,比如为一个角色对特定事件的反应生成多种备选台词。
当你的游戏已经在使用预设对白,且丰富变体虽有用但本身并非游戏机制时,这种选择尤其合适。原型在运行时无需该工具即可运行。评估该工具的标准应是其建议在经过审查后是否可用且符合团队的写作流程——而不是去统计原始生成了多少行文本。参考资料描述的是育碧的工具和工作流;它并不能证明同样的方法适用于每个团队或每个项目都能节省时间。
在扩大范围之前先进行微型游戏测试
在扩大范围之前先进行微型游戏测试
这里提供一个说明性的测试思路,而非来自已发表研究的结论。设想一个原型:玩家必须探听出守卫的巡逻线索并通过一扇门。为一小群测试者提供三个版本:一个版本中守卫接受自由形式的提问,一个版本提供预设对白选项及可选的反应性评述,还有一个完全预设的版本。在各个版本中保持目标和线索完全一致。
记录每次尝试的三件事:玩家是否获得了线索、他们是否能打开门,以及他们在哪里卡住或停滞等待。同时记录对话是否改变了玩家做出的决策。如果自由形式的对话带来了多样化的措辞,但并未对玩家的路线或选择产生实质改变,这就说明在该原型中将其作为核心交互的依据并不充分。如果预设路径运行清晰且可选反应并未对其造成干扰,那么辅助层角色可能就已经足够了。如果团队的主要难点是撰写额外的守卫闲聊喊话,而玩家任务已经得到满足,那么就在可玩版本之外去测试创作者工具。
这些观察有助于决定原型的下一次迭代;微型游戏测试无法确立普遍规律,也无法预测更广泛的受众会作何反应。将测试版本控制在足够小的规模,以便你能够对比玩家任务、回退方案以及维护各自所需的工作量。
用三个问题做出决定
在引入 AI 对白之前,写下这些问题的答案:
**玩家试图通过对白达成什么目标?** 请明确列出一项行动或决策,而不是简单的一句“进行自然的对话”。
**成功的交互应该产生什么后果?** 指明具体的信息、选择或允许的状态变更,然后决定如何在测试中观察到它。
**当生成不可用或偏离目标时会发生什么?** 提供一条预设路径,确保玩家仍有能力完成任务。
然后对照原型的规模评估制作负担:状态和触发器的数量、角色与情境引导的篇幅、生成内容所需的审查工作量,以及你必须编写的回退内容。面向玩家承诺越大的角色定位,维持输出有用性和一致性的责任也就越大。对于小型原型,小范围的定向测试能告诉你增加的负担是否切实服务于玩家任务。
这一抉择并不是对游戏中 AI 技术的盖棺定论。它只是在决定:在这一特定的可玩体验中,生成式对白究竟应该归于何处——是在玩家行为的核心,在一个受控的辅助角色中,还是在创作者的工作流程里。选择能够展现出你希望玩家体验到的效果的最小定位,让原型本身为你提供扩展它的理由。
