Metlivi 部落格

加入少許生成對白能否讓固定的遊戲劇本更有趣?

可以——前提是生成內容僅增添局部變化,而原創情節節點仍掌控後續走向。保持目標、轉折點與結果固定;讓少數對白欄位在明確限制內變化,例如角色的語氣或他們注意到的細節。接著將該版本與使用相同場景和玩家選擇的純腳本版本進行比較。觀察玩家是否認為這些對白新穎或富有反應性,同時檢查任一版本是否會對角色、事件或遊戲狀態造成更多混淆。

2026年9月30日6 分鐘閱讀閱讀、藝術與文化作者:Metlivi Editorial Team
第 1 節

混合方法旨在改變什麼

混合敘事將重大事件保持在直接的創作者控制之下,並在這些事件周圍的選定台詞中使用生成內容。例如,場景可能總是以店主打烊開始,呈現相同的玩家選擇,並以相同的線索結束。生成的台詞可能會改變店主對天氣的評論或對玩家的問候方式,但不應捏造新線索、改變選擇,或暗示先前的事件以不同的方式發生。

這個界限至關重要,因為對白可以在不改變故事狀態的情況下呈現出多樣性。互動敘事研究將 storylets(故事單元)描述為離散的敘事模組,其可用性取決於當前的遊戲狀態。另一個互動敘事系統將高層次的故事導向與自主角色行為相結合,並在玩家行為產生不一致時調整故事情節。這些範例支持了一個實用的設計原則:將預設事件和當前狀態視為結構限制,然後僅在不會與它們相矛盾的地方允許變化。(Sketching a Map of the Storylets Design Space;Mixing Story and Simulation in Interactive Narrative)

第 2 節

挑選重複感明顯但影響較小的欄位

首先找出在多次造訪或通關過程中會重複出現、且不承載關鍵資訊的對白。問候語、對玩家先前行為的簡短反應,或是一句烘托場景氛圍的台詞都是合適的候選者。揭露秘密、承諾、指示或關於物品歸屬的陳述則是不佳的首選欄位:改變其含義可能會破壞情節或玩家對世界的理解。

在編寫或生成變體之前,先為每個欄位寫下其任務。記錄發言者是誰、該角色知道什麼、剛發生了什麼、合適的情感範圍,以及哪些事實必須保持不變。設定明確的長度限制,並定義禁止添加的內容,例如新任務、物品、關係或過去事件。當替換一句台詞不會改變場景的遊戲結果或玩家需要記住的事實時,該欄位即具有明確邊界。

這是一項設計建議,並非斷言每句生成的台詞都會令人耳目一新。有些玩家可能不會注意到微小的變化;其他人可能會發現,即使是組織良好的台詞也會破壞節奏緊湊的場景。測試應確定這種變化是否有助於這款特定的遊戲和受眾。

第 3 節

讓純腳本版本成為公平的對照標準

為同一段簡短的可遊玩內容建立兩個版本。在對照版本中,在每個候選欄位中使用現有的預設台詞。在混合版本中,保留相同的預設情節節點,並僅在這些欄位中替換為生成的對白。保持場景順序、選擇、獎勵、角色外觀和遊玩指示一致。如果這些元素不同,就很難判斷玩家的反應是因為對白變化還是由於其他改變。

在招募玩家之前決定你想了解什麼。一個實用的問題是:「有限定的對白是否會讓這個場景感覺反應更靈敏或重複感更低,同時不會降低對發生事件的理解?」使用背景相當的玩家並給予他們相同的任務。如果參與者遊玩了兩個版本,請考慮初次遊玩可能會讓他們熟悉場景;如果由不同的組別遊玩各個版本,組間差異可能會影響比較結果。無論選擇哪種設定,都要注意其限制。

遊戲使用者研究指南建議根據研究目標選擇方法,並在有幫助時結合觀察、問卷和訪談。觀察能展現玩家的行為,問卷可讓評分更容易比較,訪談則有助於解釋行為,儘管每種方法都有其侷限性。對於此測試,請記錄遊玩行為並收集簡短的遊玩後評分或進行訪談,而不是僅依賴「有趣嗎?」這類單一的概括性問題。(Choose the Right Playtest Method)

第 4 節

分開追蹤創意變化與狀態一致性

使用兩張獨立的計分卡,以免生動的台詞掩蓋了連貫性問題。第一張衡量變化是否可被察覺且實用。遊玩後,詢問玩家對白是否感覺重複、角色的反應是否顯得靈活,以及是否有任何台詞令人印象深刻。請他們指出具體的時刻,而不僅僅是給出一個數字分數。在遊玩過程中,注意玩家是否暫停、重讀或對某句台詞發表評論,但不要認為引起注意就必然代表喜歡。

第二張計分卡檢查一致性。將每句生成的台詞與簡短的狀態事實清單進行比對:角色身分與認知、位置、先前的行動、當前目標,以及場景中早先確立的事實。記錄矛盾、無根據的新陳述,以及玩家顯得不確定發生了什麼的時刻。同時要求玩家總結場景的關鍵事件和下一個目標;理解不一致可能指向認知問題,儘管小規模的遊玩測試本身無法確定其發生的原因。

狀態追蹤值得特別關注。一項將《龍與地下城》設定為對話任務的研究,將生成下一輪對話和從對話歷史中預測遊戲狀態視為相關但截然不同的挑戰。其資料集包含了部分狀態標註,作者對生成的對話和狀態預測都進行了評估。該研究雖然並不能證明某個特定的混合設計一定有效,但它強化了為什麼應該將敘事變化與狀態準確性分開衡量的觀點。(Dungeons and Dragons as a Dialog Challenge for Artificial Intelligence)

第 5 節

將結果視為設計決策,而非對生成技術的定論

以相同的指標比較各個版本。玩家是否注意到了對白的變化?他們是否將某個具體反應描述為更貼切或重複感更低?他們是否理解了相同的場景事實和目標?混合版本是否引入了任何連貫性錯誤?有價值的結果可能是好壞參半的:玩家可能會喜歡多樣化的問候,但發現生成的解說難以理解。這意味著應該保留問候欄位,並移除或收窄解說欄位。

結合玩家的評論和狀態檢查記錄,檢視玩家看到的實際台詞。平均值可能會掩蓋一個嚴重的矛盾,而令人難忘的個案可能會誇大罕見事件。如果某句台詞違反了必要的事實,請在解讀喜愛度結果之前將其視為需要修復的缺陷。如果玩家沒有注意到變化,在將生成內容擴展到整個劇本之前,請先檢查該欄位是否太短或太微不足道。

一項針對角色扮演遊戲的研究比較了靜態、改寫、混合和完全生成的對白,該研究透過 64 名參與者收集了行為日誌和遊戲後問卷。其報告的結果顯示,生成自主性的程度可以影響互動與投入感,但這些發現僅屬於該遊戲和該研究,並不是對其他作品的預測。對於小型設計實驗而言,實際的做法是在預期的遊玩情境中直接比較不同的對白方式。(Quest of Aivengarde: Comparative Study of Player Experience Across LLM Dialogue Systems)

第 6 節

僅擴展通過雙重檢查的欄位

如果混合版本產生的台詞能被玩家注意到並受到讚賞,同時又能保持相同的場景理解和狀態事實,請嘗試第二組影響較小的小型欄位。保持固定節點不變,並重新進行比較。如果某個欄位增加的感知變化很少,或者反覆造成困惑,請將其恢復為預設對白或收緊其限制邊界。

幾句精心挑選的生成台詞可以讓重複的時刻感覺不那麼千篇一律,但它們是否能讓遊戲變得更有趣,對玩家來說是一個需要實證的問題。保留故事的核心事件,僅對具有明確局部目的的對白進行變化,並透過對照遊玩測試來衡量創意的回報與維持連貫性的成本。

相關閱讀

繼續探索這個主題