Algorithmes et Académiciens : L'élite littéraire française face au miroir de l'IA

Un roman à succès, présélectionné pour de grands prix littéraires français, est accusé d'avoir été écrit par un logiciel, exposant les fragiles prétentions de l'établissement éditorial.

Algorithms and Academicians: France's Literary Elite Faces the AI Mirror

L'établissement littéraire parisien se targue de son bon goût, pourtant sa dernière coqueluche automnale a plongé critiques et éditeurs dans un embarras inconfortable. C'était ça ou mourir, un roman de Thélyson Orélien, écrivain québécois d'origine haïtienne de 38 ans, s'est vendu à plus de 35 000 exemplaires et a décroché des places convoitées sur les premières listes du prix Goncourt, Femina, Médicis et Renaudot. Aujourd'hui, un collectif numérique anonyme affirme que le chef-d'œuvre célébré de la saison pourrait n'être qu'le produit d'une machine bien sollicitée.

Le scandale a éclaté lorsqu'un compte obscur sur X, opérant sous le nom de Balance ton Claude, a publié les résultats de tests de Pangram, un outil de détection américain avec un taux de faux positifs rapporté de 0,0041 %. Plusieurs passages du manuscrit d'Orélien ont obtenu un score IA de 100 %. Selon le collectif, l'intelligentsia parisienne sous-estime régulièrement les modèles de langage automatisés et n'a tout simplement pas réussi à repérer les schémas syntaxiques prévisibles, les aphorismes répétitifs et les tournures stéréotypées.

La réponse de la maison d'édition Grasset a été aussi rapide que défensive. Rejetant les affirmations comme des rumeurs sans fondement, l'éditeur, propriété de Vivendi, a affirmé que les outils de détection hallucinent fréquemment, suggérant sèchement qu'un tel logiciel classerait probablement la Bible comme synthétique. Dans un communiqué officiel publié par Grasset, Orélien a repoussé les accusations, expliquant que les procédés stylistiques répétitifs proviennent des traditions poétiques haïtiennes et caribéennes plutôt que des algorithmes numériques. Il a noté : « Les gens peuvent discuter de mon style, mais transformer ses procédés en preuve d'intelligence artificielle n'a rien à voir avec la critique littéraire. »

Pourtant, le soupçon n'est pas né de nulle part. Des lecteurs et des confrères écrivains avaient déjà exprimé des réserves sur le rythme mécanique du livre. Sur la plateforme littéraire Babelio, un critique avait décrit la prose comme creuse et stéréotypée bien avant que l'analyse logicielle ne fasse surface. L'auteur Fabrice Colin a également souligné des tics stylistiques déplaisants et des maximes répétitives en fin de chapitre qui affaiblissaient la structure narrative. Inversement, les défenseurs affirment que les algorithmes de détection s'appuient sur des ensembles de données français standardisés, ce qui signifie qu'une syntaxe non standard, créolisée, mêlant créole haïtien, espagnol et rythmes oraux, peut facilement déclencher des anomalies statistiques.

Que le roman s'appuie sur des outils automatisés ou qu'il tombe simplement sur une formule répétitive qui les imite, l'épisode expose une réalité inconfortable pour la machinerie culturelle française. Comme l'a observé le libraire lyonnais Gwilherm Perthuis, les systèmes génératifs ne font que synthétiser des archétypes à partir de données préexistantes moyennes, remettant en question l'utilité d'un créateur qui externalise l'invention. Avec les décisions des jurys prévues tout au long du mois de novembre, les institutions culturelles d'élite du pays sont confrontées à un dilemme délicat : couronner une percée littéraire, ou risquer d'attribuer leurs plus grands honneurs à un algorithme.

Écrit par Sandy van Dongen sandy.vandongen@alpineweekly.com