Thélyson Orélien et l’IA : peut-on prouver qu’un texte est écrit par une IA ?
Aucun outil ne peut prouver qu’un texte a été écrit par une intelligence artificielle. Je le dis depuis 2023 : AUCUN outil ne peut PROUVER qu’un texte est produit par une IA. Cette phrase peut sembler provocatrice au moment où un roman en lice pour le Goncourt est mis en cause sur la foi de captures d’écran d’un détecteur, et où des rédactions entières ont répliqué le test. On peut la reformuler en : Thélyson Orélien et l’IA : peut-on prouver qu’un texte est écrit par une IA ? Elle est pourtant la conclusion commune des mathématiciens qui ont étudié la question, des concepteurs des meilleurs détecteurs, et des chercheurs qui les ont évalués de manière indépendante.
La confusion vient de ce que le mot « détecteur » recouvre des objets très différents. Certains mesurent la prévisibilité d’un texte, d’autres apprennent à distinguer deux corpus, d’autres encore cherchent une signature déposée par le générateur. Ces objets n’ont ni les mêmes forces, ni les mêmes angles morts, ni le même rapport à l’idée de preuve. Ils ont en commun de produire un score, et ce score est presque toujours mal lu.
Cet article explique ce que ces outils calculent réellement, pourquoi leur résultat ne peut pas constituer une preuve, comment lire leurs taux d’erreur, et pourquoi le simple choix du passage soumis peut changer le verdict. Il décrit ensuite un phénomène plus lent mais plus profond : les tics d’écriture des modèles se répandent dans l’écriture humaine, et la suspicion d’IA devient le réflexe par défaut face à tout texte un peu lisse. Les sources sont indiquées au fil du texte et rassemblées à la fin.