Logo NB LECTURES NB LECTURES NAJIB BENSBIA WEB
Retour au magazine
POINT DE VUE

Peut-on reconnaître l'empreinte de l'IA sur des textes ?

Peut-on reconnaître l'empreinte de l'IA sur des textes ?
Des journalistes du média britannique ‘’The Economist’’ ont comparé des contenus écrits par l'humain avec ceux générés par l'IA. Ils auraient mis en lumière les caractéristiques qui permettent de reconnaître les productions des Chatbots. Si leurs conclusions peuvent sembler a priori ‘’correctes’’, il leur manque la pertinence nécessaire pour être convaincantes comme le montre la note (1) en bas de l’article. Voici l'économie globale de cet article.

Par Laurène Bruncher I The Ecnomist
L'intelligence artificielle (IA) est désormais partout: sur les affiches de vos fêtes de village, dans votre boîte mail ou sur votre fil d'actualité LinkedIn. Elle est si présente en ligne qu'elle générerait, selon une étude menée par les chercheurs de l'université de Stanford et de l'Imperial College London, plus d'un tiers des contenus de sites web mis en ligne entre 2022 et 2025.
 
En mai dernier, l'IA s'est immiscée dans l'actualité littéraire: certains ont affirmé que le prix international de la nouvelle du Commonwealth a récompensé un texte généré par IA. La Fondation du Commonwealth a démenti cette information. Dès lors, comment savoir si un écrivain virtuel intervient dans ce que vous lisez? Le média The Economist propose des pistes.
 
 Aujourd'hui, l'IA peut tout faire, de la prose à la poésie, en passant par le style journalistique ou le jargon d'entreprise. Elle est aussi polyvalente que rapide et sait surtout imiter le style de n'importe quel auteur. « Il n'existe pas de style d'écriture unique généré par l'IA, tout comme il n'existe pas de style d'écriture unique pour les humains », affirme Karolina Rudnicka, linguiste à l'université de Gdańsk, en Pologne.
 
Pourtant, les bots ont quelques automatismes qui peuvent attirer l'attention. Le tiret long, que l'on nomme aussi tiret cadratin, est devenu la signature des textes créés par IA. Au point que certains choisissent de le bannir de leurs productions pour éviter tout mépris. Des phrases plus longues et moins de ponctuation(1). Le magazine ‘’The Economist’’ a mené une étude pour reconnaître les caractéristiques qui différencient un texte réalisé par un agent conversationnel d'une production humaine.
 
 Pour cela, les journalistes ont utilisé leurs propres articles, certains qu'il s'agit d'une patte humaine. Ils ont ensuite demandé à ChatGPT, Claude, Gemini et Grok de rédiger d'autres versions de leurs papiers. « Nous avons ainsi constitué un corpus regroupant des textes rédigés par les humains et d'autres générés par l'IA, que nous avons comparés sur un total de 55.940 phrases et 1,2 million de mots », écrit le média.
 
 Pour vérifier leurs résultats, les journalistes ont ensuite réalisé les mêmes essais avec du contenu provenant de CNN, du New York Times et du Washington Post, ainsi qu'avec la prose de romans à succès. Leurs conclusions: l'IA se remarque par le choix de termes scientifiques ou rares, par la ponctuation et par la structure des phrases et des paragraphes.
 
 La plupart de contenus réalisés par la technologie font penser au langage prétentieux que George Orwell dénonçait dans son essai La politique et la langue (1946). Les modèles de langage emploient davantage de mots rares, volontairement longs et compliqués, comme par exemple «interdépendance» ou «réindustrialisation». Ils n'hésitent pas à utiliser du jargon scientifique sans expliquer clairement le sens des expressions.
 
 Les agents conversationnels ont également tendance à nominaliser les verbes. Côté ponctuation, les tirets ont désormais presque disparu, tout comme les virgules et points-virgules. À la place, les phrases se sont allongées et complexifiées, pour devenir moins percutantes. L'étude a démontré que l'IA s'améliore et se corrige à chaque mise à jour, devenant de plus en plus difficile à déceler. «Les grands modèles de langage sont entraînés sur des textes humains et apprennent grâce aux retours des utilisateurs», conclut Thomas Juzek, professeur en linguistique informatique à l'université d'État de Floride.
 
Notes :
 
(*) Article repéré et publié par Slate.fr

(1) Les développements mis en relief dans cet écrit semblent néanmoins vagues et moyennement convaincants, puisque les articles académiques, para-universitaires ou/et écrits par les enseignants et généralement ceux qu'on appelle les ''intellectuels'' sont et ont été toujours longs, utilisant des termes techniques et scientifiques compliqués avant même l'apparition de l'IA. Les ''arguments'' donnés dans cet article - comme par exemple le tiret long ( __ ) dont userait abusivement l’IA dans les textes qu’elle produit - sont légers et peu efficients pour réellement détecter si un texte a été écrit (en tout ou partie) par une IA ou un humain, comme nous l'avons fait remarquer précédemment dans cette note – NDLR NB LCTURES. Il est entendu que l'IA produit des textes dans toutes les disciplines. Il faut juste nuancer les cas où les auteurs font état de l'aide d'une IA dans leurs travaux et les autres. Toute généralisation est en elle-même porteuse de ''stigmates''. C'est ce que nous avons fait lorsque nous avons préparé un article documenté par l'apport de 3 IA (ChatGPT 5.0, Gemini et Pilot). Nous avons bien souligné que ledit article intitulé " Géopolitique mondiale : Fragmentation des puissances et un nouvel équilibre introuvable " a été élaboré avec l'aide d'IA en précisant de manière exacte quel a été cet apport.

D'ailleurs plusieurs enseignants des années 1970-2000 écrivaient des textes longs, arboré des paragraphes entiers prenant le 1/4 de la page avant de mettre un point et, le plus souvent, sans aucune virgule. Ce 2è ''appui'' central des journalistes de The Economist ne tient pas la route, comme expliqué précédemment. Un dernier point, bien que nous puissions continuer les comparaisons à l'infini, a trait à l'utilisation par l'IA de termes ''rares''. Je crois que les journalistes de The Economist n'ont jamais, ou alors exceptionnellement, lu des textes (articles ou ouvrages) écrit par des intellectuels des années 1970 - 2000 et dont certains sont encore vivants et continuent d'écrire de la même façon, en utilisant des ''termes rares'', voire pédants. C'est ce qui distinguait les ''vrais'' intellectuels des autres.

Cette longue note ne réfute nullement le recours de nombreux ''écrivains'' ou ''journalistes'' à l'IA pour écrire intégralement ou en partie un texte puis le ''retapent'' pour donner (et se donner) l'illusion qu'ils en sont les auteurs. L'IA intervient effectivement dans tous les domaines, et plus encore dans ceux à la technicité avérée. Il ne sert à rien de prêcher dans ce qui est aujourd'hui de notoriété publique. 

Le choix de reproduire ici cet article de The Economist, repéré et publié en français par le magazine ''Slate'', procède de notre volonté de souligner que la manipulation a des relents qui ne sont pas toujours pavés que de bonnes intentions...