NapseflowNapseflow
Géopolitique

Affaire Thélyson Orélien : les outils de détection de l’IA dans les textes sont-ils fiables ?

Courrier International · mis à jour il y a 2 h

“C’était ça ou mourir”, le roman du Québécois d’origine haïtienne Thélyson Orélien, aurait été entièrement écrit par une IA. Mais peut-on le prouver ? Comment fonctionne un logiciel de détection comme Pangram, celui utilisé par le compte X qui a lancé les premières accusations ?.

Affaire Thélyson Orélien

Le roman C’était ça ou mourir, écrit par l’auteur québécois d’origine haïtienne Thélyson Orélien, est au cœur d’une polémique. Un compte sur le réseau social X (anciennement Twitter) a accusé l’ouvrage d’avoir été entièrement rédigé par une intelligence artificielle (IA), sans que l’auteur ne le mentionne. Cette affaire soulève des questions sur l’authenticité des textes publiés et la fiabilité des outils permettant de détecter l’usage de l’IA dans les écrits. Thélyson Orélien, connu pour son engagement littéraire, n’a pas encore répondu publiquement à ces accusations, qui pourraient avoir des conséquences sur sa réputation et sa carrière.

Outils de détection de l'IA

Les détecteurs d’IA, comme Pangram utilisé pour lancer les accusations contre Thélyson Orélien, analysent les textes en repérant des structures linguistiques récurrentes. Contrairement à une idée reçue, ils ne se basent pas uniquement sur des signes visibles comme les tirets cadratins ou les listes à puces. Les logiciels comme Pangram ou ChatGPT fonctionnent selon un principe appelé modèle de langage à grande échelle (ou LLM, pour Large Language Model en anglais). Ces outils analysent des combinaisons de mots et de phrases typiques des algorithmes d’IA, qui produisent du texte en suivant un système de décision en arborescence. Chaque choix de mot influence les suivants, en s’appuyant sur des calculs de probabilités nourris par des milliers de pages de textes humains.

Fiabilité des détecteurs

La fiabilité des outils comme Pangram est régulièrement remise en question par les experts. Le New York Times et le Financial Times soulignent que ces logiciels peuvent commettre des erreurs, notamment en confondant un style littéraire complexe avec une production algorithmique. Par exemple, un texte riche en figures de style ou en rythmes ternaires peut être mal interprété comme étant généré par une IA. De plus, ces détecteurs évoluent constamment, car les modèles d’IA s’améliorent pour imiter le style humain. Aucune étude ne garantit une précision absolue, et les résultats doivent être interprétés avec prudence. Dans l’affaire Orélien, l’accusation repose sur un seul outil, ce qui limite la solidité des conclusions.

Fonctionnement des LLM

Les grands modèles de langage (LLM), comme ChatGPT ou Claude, fonctionnent en analysant des milliards de mots issus de textes humains pour prédire la suite la plus probable d’une phrase. Ce processus repose sur des calculs de probabilités, où chaque mot est choisi en fonction des précédents, créant une arborescence de possibilités. Les LLM ne comprennent pas le sens des mots, mais reproduisent des schémas linguistiques présents dans leurs données d’entraînement. Cette méthode explique pourquoi les textes générés par IA peuvent sembler fluides, mais manquent parfois de nuances ou de cohérence contextuelle. Les outils de détection exploitent ces particularités pour identifier les productions algorithmiques.

Limites des accusations

Les accusations portées contre Thélyson Orélien reposent sur un seul outil de détection, Pangram, ce qui soulève des questions sur leur légitimité. Les experts rappellent que ces logiciels ne sont pas infaillibles et peuvent produire des faux positifs, c’est-à-dire identifier à tort un texte humain comme étant généré par une IA. De plus, un texte littéraire complexe, comme un roman, peut présenter des caractéristiques linguistiques inhabituelles pour un algorithme, mais parfaitement naturelles pour un auteur. Sans preuve supplémentaire ou analyse approfondie, les accusations restent fragiles et pourraient nuire à la réputation de l’écrivain sans fondement solide.

Ce que ça pourrait changer

Cette affaire met en lumière les défis auxquels fait face l’industrie de l’édition à l’ère de l’IA. Les éditeurs et les auteurs s’interrogent sur la manière de garantir l’authenticité des œuvres, surtout lorsque des outils de détection sont utilisés pour discréditer des écrivains. Certains craignent que ces logiciels ne deviennent des instruments de censure ou de suspicion, sans que les mécanismes de vérification ne soient transparents. Par ailleurs, cette polémique pourrait inciter les auteurs à éviter l’usage de l’IA, même pour des tâches d’assistance, par crainte d’être mal compris. Le débat dépasse donc le cas d’Orélien et touche à l’éthique de la création littéraire dans un monde dominé par les algorithmes.

Sujets complémentaires

Ce contenu a été généré par intelligence artificielle à partir de l'article source. Il peut contenir des erreurs ou imprécisions.