
Controverse Thélyson Orélien : ce qu’il faut savoir sur Pangram
Le détecteur d’IA Pangram se retrouve au centre d’une controverse après son utilisation sur le roman C’était ça ou mourir de Thélyson Orélien. Selon les tests rapportés par Radio-Canada, l’outil a attribué à ce livre une forte probabilité de génération par intelligence artificielle, mais plusieurs spécialistes rappellent que ces résultats doivent être interprétés avec prudence.
Un test qui a relancé le débat
Les Décrypteurs de Radio-Canada ont soumis la version numérique intégrale du roman à Pangram. Le résultat affiché par l’outil est sans ambiguïté : 94 % du texte aurait été produit avec l’aide de l’IA. Cette conclusion a nourri les soupçons autour de l’ouvrage, déjà discuté dans les médias et sur les réseaux sociaux.
Mais la même source rappelle qu’un tel score ne signifie pas nécessairement qu’un livre a été entièrement généré par une machine. Marzena Karpinska, professeure à l’Université Simon Fraser, explique qu’un texte long peut contenir des passages retravaillés par un humain, ce qui complique l’analyse. Elle souligne aussi que Pangram est conçu pour limiter les faux positifs, quitte à laisser passer davantage de faux négatifs.
Pourquoi Pangram est jugé différent
La chercheuse affirme que Pangram a été entraîné d’une manière particulière : ses concepteurs auraient utilisé des millions de textes humains, puis des modèles d’IA pour reformuler ces mêmes contenus avant d’entraîner le système. D’après elle, cette méthode permet de comparer statistiquement les écarts entre écriture humaine et production automatisée.
Dans les tests menés en 2024 par son équipe, Pangram affichait un taux de faux positifs de 2 %. Karpinska dit que l’outil s’est ensuite amélioré, avec un taux annoncé aujourd’hui de 0,0026 % pour des textes en français. Elle précise toutefois qu’il n’existe pas de données spécifiques pour les textes littéraires français, ce qui limite la portée de l’évaluation.
Réponses des éditeurs et limites des critiques
Face aux accusations, les éditeurs de l’ouvrage ont contesté la fiabilité des détecteurs. Boréal, au Québec, a affirmé que le travail éditorial avait été mené sans intervention de l’IA. En France, Grasset a soutenu que certains détecteurs peuvent prendre des textes humains, y compris des passages bibliques, pour de l’IA.
La chercheuse nuance cet argument : selon elle, les faux positifs peuvent apparaître sur de très courts extraits de textes anciens, mais les chapitres entiers de la Bible soumis à Pangram ont été classés comme 100 % humains. Radio-Canada a aussi testé plusieurs classiques français et d’autres ouvrages d’auteurs haïtiens ou afrodescendants : tous ont été reconnus comme humains par l’outil.
Ce qu’il faut retenir
- Pangram a attribué 94 % d’IA au roman C’était ça ou mourir dans le test rapporté par Radio-Canada.
- Marzena Karpinska estime que l’outil est plus fiable sur des textes longs, mais elle reconnaît qu’aucun détecteur ne permet une certitude absolue.
- Les éditeurs de Thélyson Orélien contestent les soupçons, tandis que les tests cités montrent que Pangram classe aussi de nombreux textes littéraires comme 100 % humains.
Source : consulter l’article d’origine.
Cette synthèse a été produite automatiquement à partir de la source citée.
