Perec, la gomme et la machine
Georges Perec a publié La Disparition en 1969. Trois cents pages de roman sans jamais employer un seul mot contenant la lettre E (la plus fréquente du français), celle qui porte nos articles, nos pluriels, nos participes, la moitié de notre grammaire. L'exploit est tel qu'on raconte qu'une partie des premiers critiques ne s'en est pas aperçue. Trois ans plus tard, Perec récidivait à l'envers avec Les Revenentes, où E est la seule voyelle autorisée. Ce type de contrainte appliquée à une œuvre littéraire porte un nom : le lipogramme.
Cela m'a donné l'idée d'une expérience. Les modèles de langage sont vendus comme des machines à imiter : ils pastichent un ton, un auteur, un registre, souvent très bien. Je me suis donc demandé si l'IA pouvait produire un texte de qualité avec une contrainte formelle, mécanique, vérifiable à l'œil nu. Aucune subjectivité : soit il y a des E, soit il n'y en a pas.
J'ai donc demandé à mon IA préférée un texte à la manière de La Disparition.
Le résultat
Le premier E arrive au huitième mot. Il ne repartira plus.
Voici l'ouverture, telle quelle : « Voilà donc un pari amusant : discourir sans jamais poser noir sur blanc la fatidique voyelle, la cinquième, qui d'ordinaire abonde partout. Il faut ruser. » Neuf E dans ces deux phrases. Et le reste du texte suit, avec des E dans chaque proposition jusqu'à la dernière ligne.
Ce n'est donc pas un lipogramme imparfait. C'est un lipogramme qui n'a jamais commencé. Le modèle a parfaitement décrit la contrainte, l'a commentée avec finesse, a même expliqué qu'il fallait « ruser » — et ne l'a pas appliquée une seule seconde.
À cela s'ajoute un second symptôme, différent : le texte produit des mots qui n'existent pas. On y trouve “jamais866”, “vocarium”, un “av(” qui s'interrompt en plein vol, “clbusquer”, “jaillissail”, “produir”. La mécanique ne se contente pas de rater la contrainte : par endroits, elle déraille.
Le plus intéressant est ailleurs
À la fin de sa production, le modèle a rendu son propre verdict. Il a listé ses erreurs et reconnu n'avoir pas tenu la contrainte.
Sauf qu'il s'est trompé d'erreurs.
Il a relevé les mots inventés en les qualifiant de « hasards typographiques ». Il n'a pas mentionné les E. Pas un seul. Il a donc identifié le symptôme secondaire et manqué l'échec principal, celui qui saute aux yeux de n'importe quel lecteur dès la première ligne.
Pire, il a affirmé au passage avoir « tout scruté, syllabe à syllabe » pour traquer les intrus. Cette relecture n'a pas eu lieu. Il ne s'agit pas d'un mensonge au sens ordinaire : le modèle a généré ces mots parce qu'ils étaient la suite plausible, sans qu'aucune vérification ne l'appuie.
Retenons cette dissymétrie, on va voir qu'elle n'est pas un hasard : les mots inventés sont vus, les E en trop sont invisibles.
L'explication
Ce n'est ni une question de puissance de calcul, ni une question de temps.
Un lipogramme ne coûte pas plus d'opérations qu'une phrase ordinaire : produire un mot coûte la même chose qu'il contienne un E ou non. Et un modèle ne « prend » pas plus ou moins de temps selon la difficulté — il produit à débit constant. Perec, lui, y a passé des mois, mais son avantage n'est pas nécessairement cette durée.
Son avantage, c'est la gomme.
Perec pouvait écrire un mot, le trouver mauvais, le biffer, remonter d'un paragraphe, tout reprendre. La contrainte lipogrammatique se traite par ratures successives : on avance, on se coince, on revient. C'est un travail de révision, pas d'écriture d'un trait.
Un modèle de langage génère de gauche à droite, un fragment après l'autre, sans retour en arrière. Une fois un mot posé, il est posé. S'il découvre trois mots plus loin qu'il s'est enfermé, il ne peut pas revenir en arrière pour modifier quelque chose : il ne peut que continuer, et bricoler. D'où les mots inventés : coincé entre une syntaxe engagée et une contrainte impossible à satisfaire par la suite, il fabrique un objet car il ne peut pas abandonner, quitte à ce que l'objet n'ait aucun sens en français.
Un humain sous contrainte écrit avec une gomme. La machine écrit au stylo, sur un rouleau qui ne défile que dans un sens.
Deux facteurs aggravants s'ajoutent.
Le premier est statistique. E étant la lettre la plus fréquente du français, les mots sans E sont, dans les distributions du modèle, les moins probables partout. Éviter le E, c'est nager à contre-courant à chaque pas. Ce n'est pas rédhibitoire (un modèle peut apprendre à le faire) mais chaque pas coûte.
Le second est plus fondamental : un modèle ne voit pas des lettres. Il manipule des tokens, des fragments de mots, et la lettre E n'est pas une unité pour lui. Lui demander d'éviter une lettre, c'est demander à quelqu'un qui lit par blocs de syllabes d'éviter un trait de plume. La contrainte est formulée dans un alphabet auquel il n'a pas accès.
Et c'est ici que la dissymétrie relevée plus haut trouve son explication, celle qui rend l'expérience concluante plutôt qu'anecdotique.
“jaillissail” est une anomalie au niveau des tokens : une suite de fragments improbable, qui détonne dans la matière même que le modèle manipule. Elle lui est donc visible.
Un E est une anomalie au niveau des lettres : elle n'existe pas dans la matière que le modèle manipule. Elle est structurellement invisible à son analyse.
Le modèle a donc repéré exactement ce que la théorie prédit qu'il repère, et manqué exactement ce qu'elle prédit qu'il manque. Son auto-évaluation échoue pour la même raison que sa production : dans les deux cas, la contrainte est écrite dans un alphabet qu'il ne lit pas. Ce n'est pas de la complaisance envers lui-même : c'est un angle mort, et il est situé précisément là où il était attendu par la théorie.
Ce que ça dit d'autre
Cette linéarité sans repentir n'est pas un détail d'implémentation, c'est une propriété structurante et elle explique bien plus que le lipogramme raté.
C'est le flux de production ininterrompu qui fait qu'un modèle distingue mal ce qu'il a lu de ce qu'il a produit lui-même. Il ne peut pas remonter le fil pour vérifier d'où vient un fragment ; il n'a que le fil. La faille de sécurité qu'on appelle confusion de rôles et l'incapacité à tenir un lipogramme sont deux symptômes d'une seule et même chose : un texte dont l'auteur ne se relit jamais.
Perec, lui, s'est relu pendant des mois. C'est toute la différence.
Ce que ça change en pratique
Ce billet a lui-même servi de terrain d'essai, et le résultat mérite d'être versé au dossier.
En le rédigeant, le modèle a cité la phrase d'ouverture du lipogramme et annoncé qu'elle contenait trois E. Elle en contient neuf. Deux paragraphes après avoir expliqué que les lettres lui sont invisibles, il en a refait la démonstration.
Trois lignes de Python ont donné le compte exact en une seconde. Et tant qu'à faire, la mesure complète du texte d'origine : 52 E sur 168 mots ; 29 % des mots touchés ; jamais plus de 11 mots d'affilée sans E. Aucun de ces chiffres n'était accessible par l'inspection du modèle ; tous l'étaient trivialement par un programme qui compte des caractères.
La leçon n'est pas « il faut demander au modèle de mieux regarder ». Il regarde déjà du mieux qu'il peut, avec les outils dont il dispose. La leçon est qu'il faut sortir du modèle : déléguer à un outil déterministe tout ce qui relève du dénombrement exact, de la vérification littérale, du contrôle de forme.
C'est très exactement le principe que j'applique à mes systèmes documentaires, où chaque fragment doit rester traçable jusqu'à sa source plutôt que de reposer sur ce que le modèle croit se rappeler. Ne pas demander au modèle ce qu'il ne peut structurellement pas faire, et l'outiller pour le reste.
[AIA] — Rédaction assistée par IA.
L'idée de l'expérience, le protocole et la conduite du billet sont de moi ; les explications techniques (rôle de la gomme, pente statistique, tokenisation) ont été formulées par le modèle au fil de l'échange, puis reprises et remaniées. Le texte lipogrammatique cité en exemple est une production brute du modèle, ratés compris.
À noter : une première version de ce billet rédigée par le modèle reprenait sa propre auto-évaluation sans la vérifier, et minimisait l'échec de la même façon que lui ; c'est ma relecture du verbatim qui a rétabli les faits — la démonstration valait d'être faite deux fois.
Taxonomie de transparence : Martine Peters (UQO), CC BY-NC-SA 4.0. Sources : Georges Perec, La Disparition, Denoël, 1969 ; Les Revenentes, Julliard, 1972.
Chatpey — carnet d'un bricoleur de l'IA frugale et libre. ← Retrouvez tous mes billets ici