Comment tester si un personnage d'IA reste captivant après dix conversations
Pour tester si un personnage de fiction animé par une IA conserve son attrait après dix conversations, offrez à un testeur un personnage et un cadre cohérents, puis invitez-le dans dix situations distinctes et crédibles. Observez les scènes qu'il choisit, vérifiez si le personnage reste fidèle au canon établi, notez les nouveaux éléments narratifs générés par chaque échange et regardez si le testeur choisit d'aller jusqu'au bout de la série. Considérez cela comme des indices concrets pour améliorer le personnage, et non comme une mesure de la durée pendant laquelle on peut maintenir quelqu'un en train de discuter.
Définir ce que signifie « rester captivant » pour ce test
Une dixième conversation doit révéler si le personnage peut continuer à offrir un jeu d'interaction intéressant une fois l'effet de nouveauté passé. Dans le cadre de cet exercice, l'attrait signifie que le testeur trouve des raisons de choisir des scènes variées, parvient à reconnaître le personnage à travers des circonstances changeantes et tire quelque chose d'utile ou de surprenant de l'échange. L'achèvement du test est un acte volontaire final : le testeur choisit de terminer la dixième conversation prévue. Aucune de ces observations ne prouve à elle seule que chaque joueur trouvera le personnage captivant.
Gardez une question précise : « Ce personnage offre-t-il suffisamment d'éléments cohérents et inédits pour que ce testeur choisisse de mener à bien dix conversations ? » N'utilisez pas le temps total passé comme score décisif. Un échange prolongé peut refléter une scène prenante, mais il peut aussi être le signe d'une confusion ou d'une consigne ambiguë. La question du test de jeu d'un personnage concerne le choix des scènes, le respect du canon, la nouveauté et l'achèvement volontaire, et non pas de savoir si un abonnement grand public vaut son coût sur une période de quatorze jours.
Préparer une fiche de référence canonique et dix propositions de scènes
Avant le test, rédigez une courte fiche de référence canonique avec les faits que le personnage doit respecter : son rôle, son passé important, ses préférences établies, ses relations, ses limites et sa manière distinctive de s'exprimer. Incluez également quelques traits plus flexibles : son comportement face à la surprise, ce qu'il remarque ou les types de détails qu'il a tendance à ignorer. Cela rend la cohérence observable sans exiger du personnage qu'il répète sans cesse les mêmes répliques fétiches. La recherche sur les agents de dialogue conditionnés par un profil (persona) traite la cohérence du personnage comme une qualité à évaluer, et une étude sur les agents basés sur des modèles de langage en interaction a révélé que les profils différaient en matière de cohérence et d'alignement linguistique au cours de l'interaction. Ces études justifient l'observation du comportement sur plusieurs échanges ; elles n'établissent pas un seuil universel de dix conversations. (Building Persona Consistent Dialogue Agents with Offline Reinforcement Learning ; LLM Agents in Interaction: Measuring Personality Consistency and Linguistic Alignment in Interacting Populations of Large Language Models)
Préparez dix propositions de scènes qui créent des opportunités variées sans dicter les répliques du personnage. Par exemple, le personnage pourrait avoir besoin de choisir un petit cadeau, de planifier une visite dans un endroit familier, de dissiper un malentendu anodin, d'aider à organiser un événement communautaire ou de décider quoi faire d'un après-midi libre inattendu. Maintenez chaque proposition dans l'univers établi du personnage et dans le cadre de choix personnels ordinaires. Variez la situation et le type de décision, tout en conservant suffisamment de continuité pour que les événements antérieurs puissent avoir de l'importance.
Évitez de rédiger dix versions d'une même consigne avec des modifications superficielles. Une scène utile demande au joueur de faire un choix significatif ou d'apporter sa propre idée. La recherche et la théorie sur la narration interactive considèrent que le sentiment d'action (agency) du joueur va bien au-delà de la simple présence d'options : la compréhension et l'interprétation du joueur façonnent également l'expérience. Dans ce test, cela implique d'enregistrer ce que le testeur choisit réellement et la manière dont il oriente une scène, plutôt que de simplement compter le nombre de consignes auxquelles le personnage a répondu. (Connecting player and character agency in videogames)
Mener dix conversations sans orienter vers la « bonne » réponse
Donnez au testeur une introduction brève et neutre : il essaye le personnage et les scènes, et le test porte sur l'expérience vécue plutôt que sur sa performance. Indiquez-lui qu'il peut s'arrêter à tout moment. Présentez une scène à la fois sous un format constant, en évitant de suggérer ce qui rendrait une scène palpitante ou l'option que le personnage devrait choisir. Les recommandations en matière de tests d'utilisabilité modérés préconisent des tâches claires et crédibles qui ne dévoilent pas la réponse, complétées par l'observation des participants et des questions de suivi ouvertes. Adaptez cette discipline au jeu créatif : posez clairement le cadre, puis laissez au testeur la liberté de réagir à sa manière. (Using moderated usability testing)
Après chaque échange, consignez quelques observations concrètes : la scène choisie ou développée par le testeur, l'introduction éventuelle d'une nouvelle orientation, le respect ou la contradiction du canon par le personnage, ainsi que le nouvel élément d'histoire apparu. Notez une réplique ou un choix précis lorsqu'il illustre une observation. Distinguez bien ces faits des interprétations : « le testeur a modifié le plan pour se rendre au marché » est une observation ; « le personnage a favorisé l'initiative du joueur » est une interprétation possible. Des notes concises et ciblées sur un point unique sont plus faciles à comparer d'une session à l'autre que des impressions générales. (Taking notes and recording user research sessions)
Une fois l'échange terminé, posez un petit nombre de questions neutres. « Qu'aimeriez-vous faire ensuite avec ce personnage ? » permet de voir si le testeur peut imaginer une autre scène. « Y a-t-il eu un élément en contradiction avec ce que vous aviez compris de lui ? » peut faire remonter une entorse au canon. « Quelle partie vous a semblé familière, et quelle partie vous a paru nouvelle ? » permet de déterminer si la nouveauté est venue du personnage, de la situation ou de la contribution du testeur. Demandez ce qui a motivé une réponse au lieu de fournir vous-même l'explication.
Utiliser une grille d'évaluation simple de dix lignes
Utilisez une ligne par conversation. Une échelle compacte aide à synthétiser les tendances, mais les notes et les exemples comptent davantage que les chiffres. La grille suivante est une aide pratique pour les tests, et non un instrument de recherche validé scientifiquement.
Conversation : 1–10 ; Choix ou orientation de la scène : Ce que le testeur a choisi, ajouté ou réorienté ; Canon : 0 = contradiction ; 1 = flou ; 2 = cohérent ; Nouveauté utile : 0 = se répète sans rien apporter ; 1 = quelques éléments nouveaux ; 2 = développement distinct et exploitable ; Terminé de plein gré ? : Oui / Non
Pour le canon, ne comptez une contradiction que si le personnage entre en conflit avec un fait de la fiche de référence ou un événement établi — pas simplement parce qu'il agit différemment dans une situation inédite. Pour la nouveauté, prenez en compte un détail, une décision, une évolution relationnelle ou un revirement de situation qui offre au testeur de quoi réagir ou rebondir. Un détail surprenant qui n'a aucun sens dans l'univers du personnage n'est pas une nouveauté utile. Gardez une approche descriptive pour le choix des scènes plutôt que de juger les préférences du testeur : la diversité signifie que le personnage s'adapte à différentes directions, et non que le testeur doit obligatoirement explorer un éventail prédéterminé.
Consignez l'achèvement indépendamment des autres critères. Si le testeur mène volontairement la conversation dix à son terme, notez-le ; s'il s'arrête en cours de route, demandez-lui s'il souhaite expliquer ce qui l'a poussé à s'arrêter. N'interprétez pas le fait d'aller jusqu'au bout comme une preuve d'attachement, ni l'abandon comme un échec. Une personne peut s'arrêter pour des raisons extérieures au personnage, et une série menée à son terme peut tout de même contenir des scènes répétitives ou contradictoires. La combinaison du comportement et des explications fournies est bien plus instructive qu'un simple résultat binaire.
Analyser la tendance et décider des modifications à apporter
Repérez les moments où l'expérience évolue au fil de la séquence. Si le testeur continue de choisir différents types de scènes mais que les réponses du personnage deviennent génériques, travaillez la voix et les prises de décision dans des contextes variés. Si le personnage reste reconnaissable mais que les scènes se terminent systématiquement sans décision ni détail inédit, revoyez les propositions de départ ou attribuez au personnage des objectifs et des préférences plus précis pour guider ses actions. Si le testeur commence à réorienter les scènes, vérifiez si les situations préparées n'étaient pas trop similaires, trop restreintes ou tout simplement moins stimulantes que les idées qu'il apportait.
Une voix distinctive doit transparaître dans ce que le personnage remarque, désire et exprime — pas uniquement dans un tic de langage répété. Un guide d'écriture sur le dialogue décrit la voix comme le reflet de la personnalité et recommande d'adapter les répliques aux traits de caractère, aux origines et aux émotions du personnage. Appliquez ce principe lors de la relecture d'une transcription : cette réplique pourrait-elle raisonnablement être prononcée par ce personnage dans cette situation, et témoigne-t-elle d'un point de vue reconnaissable ? (Section 8 – Writing Dialogue – A Beginner’s Guide to Storytelling)
Choisissez ensuite une modification précise et répétez le même test de dix scènes avec un autre testeur, ou lors d'une nouvelle session clairement documentée. Conservez les mêmes consignes et définitions de notation lorsque vous comparez les versions, afin qu'une variation dans le test lui-même ne soit pas confondue avec un changement chez le personnage. Si le premier essai a révélé une contradiction avec le canon, ajoutez une scène qui met naturellement à l'épreuve le fait concerné ; s'il a mis en évidence des échanges répétitifs, introduisez des situations impliquant d'autres types de choix. Il s'agit d'une démarche diagnostique, non d'une estimation statistique. Un seul testeur peut mettre en lumière des frictions et des opportunités concrètes, mais ne peut indiquer dans quelle mesure le résultat se généralisera à plus grande échelle.
Ce que dix conversations peuvent — et ne peuvent pas — vous apprendre
Le format en dix conversations constitue un test de résistance ciblé et utile : il permet d'observer si la variété des scènes, la fidélité au canon et le renouvellement des idées perdurent au-delà des premiers échanges. Il peut indiquer à quel moment un testeur particulier a perdu l'intérêt, a décelé une piste prometteuse ou s'est heurté à une contradiction. En revanche, il ne prouve pas l'attrait à long terme, ne prédit pas la fidélisation et n'établit pas la façon dont l'ensemble des publics réagira. Utilisez-le pour identifier ce qu'il faut examiner et ajuster, puis multipliez les tests si vous souhaitez obtenir des certitudes sur différents types de lecteurs et de manières de jouer.
Le signal le plus clair réside dans l'apparition d'une tendance appuyée par des exemples : le testeur a eu la liberté de choisir, le personnage a réagi en accord avec le canon établi, les scènes ont fourni des éléments distincts sur lesquels s'appuyer, et le testeur a choisi de terminer la séquence. Lorsque l'un de ces aspects fait défaut, les notes doivent orienter la décision d'écriture suivante — ajuster la voix du personnage, clarifier le canon ou repenser les propositions de scènes — plutôt que de simplement ajouter des amorces de conversation supplémentaires.
