Nostyss

Nostyss

← Tous les articles
PersonnagesCohérenceFiction interactive

La théorie de l'esprit : pourquoi les meilleures histoires parlent de qui sait quoi

Par Pierre Bonnet · · 7 min de lecture

Vous savez que l'aubergiste a empoisonné le vin. Votre compagne, non. Elle lève sa coupe, et pendant une phrase toute l'histoire tient dans l'écart entre ce que vous savez et ce qu'elle croit.

Ce qu'est la théorie de l'esprit

Les psychologues la testent avec une bille. Sally range la bille dans son panier et quitte la pièce. Anne la déplace dans sa boîte. Sally revient. Où va-t-elle chercher ?

Pour répondre dans le panier, il faut tenir deux versions du monde à la fois : où est la bille, et où Sally croit qu'elle est. La plupart des enfants y parviennent vers quatre ans. Les plus jeunes répondent souvent là où la bille se trouve vraiment, parce que pour eux il n'existe qu'un monde, le vrai.

La fiction est une machine à écarts de savoir

Les histoires sont faites de cette double comptabilité. La chercheuse en littérature Lisa Zunshine soutient que nous aimons la fiction parce qu'elle nous invite sans cesse à deviner d'autres esprits, ce que notre cerveau fait de toute façon en permanence (Why We Read Fiction, 2006). Regardez de quoi sont faits les plus vieux ressorts du récit :

  • L'ironie dramatique. Le public sait ce qu'un personnage ignore. Dans Roméo et Juliette, nous savons que Juliette ne fait que dormir ; Roméo ne le sait pas, et agit selon ce qu'il croit.
  • Le suspense. Le public sait que le danger arrive, les personnages non.
  • Le mystère. Personne ne sait encore, et le lecteur découvre en même temps que l'enquêteur.
  • Le mensonge et la trahison. Quelqu'un agit sur une croyance fausse que quelqu'un d'autre a plantée, ou sur une loyauté qui n'a jamais existé.
  • Des esprits dans des esprits. Elle soupçonne qu'il sait qu'elle a menti. Le lecteur suit plusieurs de ces étages sans même s'en apercevoir.
Même scène, mêmes événements. Seule la répartition du savoir a changé.

Certains chercheurs sont allés plus loin et ont affirmé que lire de la fiction littéraire entraîne cette capacité. Une étude parue dans Science en 2013 disait exactement cela. Quand les mêmes auteurs ont mené trois réplications préenregistrées, les résultats ont été mitigés : une réussite, et deux échecs qui ne tranchent pas la question (Kidd et Castano, 2019). Dans deux de ces expériences, les lecteurs jugeaient aussi les personnages de fiction populaire plus prévisibles et plus stéréotypés que ceux de fiction littéraire. Que la fiction entraîne ou non la théorie de l'esprit, elle en vit.

Pourquoi un narrateur IA se trompe par défaut

Un modèle de langage qui écrit une histoire voit d'un coup tout ce qui est dans son contexte : le plan du méchant, le secret de l'héroïne, le nom de l'inconnu que vous n'avez pas encore rencontré. Rien dans ce texte ne dit qui était dans la pièce quand une chose a été dite. Son réglage par défaut est donc une distribution omnisciente, où chaque personnage sait ce que sait le prompt.

Une inconnue à la porte
Vous

Je demande à la femme de la porte le chemin du vieux moulin.

Le récit

« Bien sûr, Elowen, dit-elle. Mais je vous croyais capable de retrouver le moulin de votre père. »

Personne ne lui a dit votre nom, ni qui était votre père.

Dans nos propres parties de test ce mois-ci, nous avons croisé les trois fuites classiques : un nom que le héros n'avait jamais entendu, une vérité cachée écrite en clair dans la prose, et un coup de théâtre éventé avant sa scène.

Ce n'est pas que les modèles ne savent pas raisonner sur des croyances. Face à une énigme classique de fausse croyance, les modèles récents la résolvent souvent : une étude de 2024 trouve GPT-4 capable de résoudre 75 % de ses tâches, à peu près comme des enfants de six ans (Kosinski, PNAS). D'autres ont montré que de petites modifications des mêmes énigmes suffisent à les faire échouer (Ullman, 2023), et le débat reste ouvert. Dans une histoire, le problème vient avant tout raisonnement : on donne tout au narrateur, et rien ne sépare ce que chaque personnage a réellement vu.

Ce que cela ouvre pour le joueur

Quand une histoire tient qui sait quoi, une manière de jouer apparaît, qu'une distribution omnisciente rend impossible :

  • Le bluff. Vous mentez à un garde, et le mensonge tient, parce qu'il n'a aucun moyen de savoir mieux.
  • Le secret. Ce que vous cachez reste caché jusqu'à ce que vous, ou l'histoire, le révéliez.
  • L'enquête. Les indices se trouvent, ils ne se récitent pas. Personne ne vous tend la réponse parce que le narrateur la connaît.
  • Le malentendu. Quelqu'un agit sur une croyance fausse, et les conséquences sont réelles.
  • La trahison. Un allié savait depuis le début, et il y a une scène où vous le comprenez.
  • La surprise. L'histoire sait quelque chose que vous ignorez, et le garde.
La scène d'ouverture en trois faits et trois esprits. Le drame est dans les cercles vides.

Ce que nous construisons, dans les grandes lignes

Nostyss tient qui a rencontré qui et qui a appris quoi, et écrit chaque scène depuis ce que sait votre personnage. Un secret reste hors de la prose jusqu'à ce que l'histoire le révèle. Quelqu'un que vous n'avez pas rencontré est décrit plutôt que nommé, jusqu'à ce que l'histoire le présente.

C'est un travail récent, et il n'est pas fini. Il compte plus pour nous que n'importe quelle fonctionnalité, parce que c'est la différence entre une histoire qui se souvient et une histoire peuplée de gens.

Ce qui casse encore

  • L'inférence. Un personnage fin devrait pouvoir deviner. Nous préférons qu'il devine plutôt qu'il sache, et tracer cette ligne est difficile.
  • Les nouvelles hors de la page. Les rumeurs voyagent entre les scènes, et l'histoire doit décider ce qui est arrivé à qui.
  • Le second ordre. Ce qu'elle croit que vous savez est plus difficile à tenir que ce qu'elle sait.
  • Les suggestions. Les choix que nous proposons peuvent encore nommer quelqu'un que vous n'avez pas rencontré.

Aucun de ces problèmes ne se règle avec un modèle plus gros. Ils se règlent, quand ils se règlent, parce que l'histoire tient mieux ses comptes.

Pourquoi c'est la partie la plus amusante

Une histoire n'est pas seulement ce qui arrive. C'est qui le sait, quand, et ce qu'on en fait. Donnez au joueur un esprit parmi d'autres esprits, et les plus vieux plaisirs de la fiction reviennent : le souffle retenu, le mensonge qui marche, la révélation qui porte.

Pour le vérifier sur n'importe quelle application d'histoires IA, le quatrième de nos cinq tests de mémoire fait exactement cela : un personnage sait-il ce qu'il n'a jamais appris ?

Questions

Qu'est-ce que la théorie de l'esprit, en termes simples ?

La capacité de comprendre que les autres ont leurs propres croyances, connaissances et intentions, qui peuvent différer des nôtres et de la vérité. C'est ce qui permet de prévoir que quelqu'un cherchera ses clés là où il les a laissées, et non là où vous les avez déplacées en son absence.

Quel est un exemple de théorie de l'esprit dans une histoire ?

L'ironie dramatique. Dans Roméo et Juliette, le public sait que Juliette a seulement bu une potion qui la fait paraître morte ; Roméo ne le sait pas, et agit selon ce qu'il croit. La scène fonctionne parce que le public tient les deux esprits à la fois.

Pourquoi les personnages d'une IA savent-ils des choses qu'ils ne devraient pas savoir ?

Parce que le modèle qui les écrit voit toute l'histoire d'un coup, y compris des secrets et des noms que les personnages n'ont jamais appris. Si l'histoire ne tient pas ce que chaque personnage a réellement vu, tous puisent dans le même savoir, et les secrets fuient.

Une IA peut-elle avoir une théorie de l'esprit ?

Les modèles récents réussissent beaucoup de tests classiques de fausse croyance : une étude de 2024 trouve GPT-4 capable de résoudre 75 % de ses tâches, à peu près comme des enfants de six ans. D'autres chercheurs ont montré que de petites modifications des tests suffisent à les faire échouer, et la question reste débattue. Dans une histoire, le problème est d'abord structurel : on dit tout au narrateur.

Qu'est-ce que l'ironie dramatique ?

L'ironie dramatique, c'est quand le public sait quelque chose qu'un personnage ignore. La tension vient de voir le personnage agir sur une croyance que nous savons fausse.

Sources

  1. Premack & Woodruff, Does the chimpanzee have a theory of mind? · Behavioral and Brain Sciences, 1978
  2. Wimmer & Perner, Beliefs about beliefs · Cognition, 1983
  3. Baron-Cohen, Leslie & Frith, Does the autistic child have a theory of mind? · Cognition, 1985
  4. Sally–Anne test · Wikipedia
  5. Zunshine, Why We Read Fiction: Theory of Mind and the Novel · Ohio State University Press, 2006
  6. Kidd & Castano, Reading Literary Fiction Improves Theory of Mind · Science, 2013
  7. Kidd & Castano, Reading Literary Fiction and Theory of Mind: Three Preregistered Replications · Social Psychological and Personality Science, 2019
  8. Kosinski, Evaluating large language models in theory of mind tasks · PNAS, 2024
  9. Ullman, Large Language Models Fail on Trivial Alterations to Theory-of-Mind Tasks · arXiv, 2023

Vérifiez si le monde se souvient vraiment

Dix mondes que vous pouvez lancer sans compte. Jouez quelques chapitres, contredisez quelque chose que vous aviez établi plus tôt, et regardez ce que le monde en fait. C'est la façon honnête de juger tout cela.

Choisir un monde

À lire ensuite

Pourquoi les histoires générées par IA oublient, et ce qu'il faut pour qu'elles se souviennent
Les longues histoires IA dérivent et se contredisent vers le dixième chapitre. La cause n'est pas un contexte trop court, et le remède n'est pas un modèle plus gros.
Comment savoir si une histoire IA se souvient vraiment : cinq tests
Toutes les applis d'histoires IA disent se souvenir. Cinq tests en une soirée montrent ce que la vôtre garde, ce qu'elle perd, et ce que coûte une correction.