Détecteurs de textes générés par IA: comment ça fonctionne et peut-on leur faire confiance?

5 days ago 3

L’écrivain canado-haïtien Thélyson Orélien, l’une des stars de la rentrée littéraire française, est la cible d’attaques sur X l’accusant d’avoir eu recours à l’intelligence artificielle pour écrire son roman « C’était ça ou mourir », ce qu’il a fermement démenti.

• À lire aussi : Écrivain québécois accusé d’avoir écrit son roman avec l’IA : une saga qui profite aux géants technologiques américains, déplore la SARTEC

• À lire aussi : Accusé d’avoir écrit son roman avec l’IA : l’écrivain québécois Thélyson Orélien se défend et se dit victime de racisme

• À lire aussi : Ce roman québécois primé a-t-il été écrit par l’IA ? L’éditeur Grasset dément les rumeurs

Les accusations, portées par un compte anonyme sur le réseau social, affirment s’appuyer sur un logiciel de détection de l’IA.

Comment fonctionnent ces outils et peut-on leur faire confiance ?

Qu’est-ce qu’un détecteur d’IA ?

Avec l’essor des intelligences artificielles génératives, capables de produire des textes similaires à l’écriture humaine, de nombreux outils se sont développés pour tenter de détecter si un texte a été écrit par une IA.

Des dizaines de ces outils sont ainsi disponibles en ligne, pour la plupart payants si l’on veut y accéder en illimité, et notamment adressés au secteur de l’enseignement et de la recherche académique.

Certains vendent également des services promettant d’« humaniser » des textes écrits par une IA.

Les différentes entreprises qui développent ces outils utilisent des méthodes différentes pour paramétrer leurs systèmes de détection.

Toutefois, elles ont toutes pour point commun d’avoir construit ces dispositifs en analysant d’importantes bases de données regroupant des textes générés par des modèles d’IA et des textes rédigés par des humains.

Et d’après plusieurs écrits publiés par des chercheurs, ces systèmes de détection, encore très lacunaires il y a quelques années, ont vu leurs performances s’améliorer largement.

Sur quoi se fonde la détection ?

Pour tenter de déterminer si un texte a été rédigé par une IA, ces outils « recherchent des régularités », explique Thierry Poibeau, directeur de recherche au CNRS, spécialiste du traitement automatique des langues.

« L’idée étant que ces textes générés automatiquement, mais c’est de moins en moins vrai, ont des tics de langage », explique-t-il.

L’entreprise Pangram, fondée en 2023 et dont l’outil a été utilisé par un compte sur X pour scanner deux passages du livre de Thélyson Orélien, affirme ainsi être en capacité de « détecter un texte généré par une IA en analysant et en comprenant les signaux subtils présents dans l’écriture ».

Capture d'écran du site Pangram.com 

« L’exemple classique, c’est les tournures ternaires, ou les tirets cadratins, qui étaient très fréquents dans les textes générés, parce que les outils avaient été entraînés sur des textes scientifiques américains ou des romans américains, dans lesquels il y avait beaucoup de structures ternaires », illustre M. Poibeau.

Ces outils sont-ils fiables ?

De nombreux outils disponibles sur le marché mettent en avant des scores de fiabilité supérieurs à 99 % dans la détection des textes générés par IA.

Néanmoins, les résultats qu’ils affichent ne suffisent pas à affirmer de manière certaine qu’un texte est rédigé par une IA.

WinstonAI, l’un des principaux acteurs du secteur créé en 2022, souligne ainsi que son outil de détection signale les textes « susceptibles d’être générés par IA ».

Chez Pangram, le PDG et cofondateur Max Spero avait souligné auprès du média américain The Atlantic, dans un article paru en mai 2026, que son outil ne devrait « jamais être l’arbitre final » mais plutôt un point de départ pour une enquête plus approfondie.

D’après Thierry Poibeau, ces systèmes de détection se heurtent aussi à un « problème de cible mouvante », puisque « les modèles d’IA évoluent en permanence » et tentent de se rapprocher toujours plus du langage naturel.

Le spécialiste pointe enfin une potentielle impasse s’agissant de la détection de l’utilisation de l’IA dans les romans.

« L’outil peut relever dans l’écriture quelque chose de particulier, quelque chose de répétitif, mais c’est peut-être ça qui fait le style d’un écrivain », explique-t-il.

*** Disclaimer: This Article is auto-aggregated by a Rss Api Program and has not been created or edited by Bdtype.

(Note: This is an unedited and auto-generated story from Syndicated News Rss Api. News.bdtype.com Staff may not have modified or edited the content body.

Please visit the Source Website that deserves the credit and responsibility for creating this content.)

Watch Live | Source Article