IA chez Frontières : 37 articles sur 50 dépassent 50 % selon Pangram, un résultat à nuancer
Le 29 septembre 2026, CheckNews a rapporté que 37 articles de Frontières sur 50 soumis au détecteur Pangram obtenaient un score de recours à l’IA supérieur à 50 %. Ce résultat constitue un signal à examiner, pas une me directe des pratiques de rédaction du média. Notre vérification distingue donc le chiffre annoncé de la conclusion plus large selon laquelle Frontières utiliserait fortement l’IA pour les articles de son site. (collector.com.tr)
L’affirmation vérifiée
L’affirmation chiffrée est celle de CheckNews : parmi 50 articles publiés sur le site de Frontières et testés avec Pangram, 37 auraient dépassé le seuil de 50 %. La question posée dans le titre de l’article de Libération est plus ambitieuse : ces résultats permettent-ils d’établir que Frontières a fortement recours à l’IA ? Il ne s’agit pas, dans les éléments accessibles, d’une déclaration attribuée à Frontières. L’article est daté du 29 septembre 2026 ; la période de publication des 50 textes testés n’est pas précisée dans le résumé disponible. (collector.com.tr)
Ce que montrent les faits
Si l’on reprend les chiffres publiés par CheckNews, 37 sur 50 représente 74 % des articles testés. Ce pourcentage décrit l’échantillon annoncé, et non nécessairement l’ensemble des articles de Frontières. Il ne signifie pas non plus que « 74 % du site » a été écrit par une IA : le résultat porte sur un nombre d’articles ayant franchi un seuil fixé pour chaque texte. (collector.com.tr)
Il faut aussi lire correctement le score. Pangram présente un score de 50 % comme une estimation de la part du document qu’il classe comme générée ou assistée par IA. Ce n’est ni une preuve que la moitié exacte des mots a été produite par un chatbot, ni une probabilité de 50 % que l’auteur ait utilisé l’IA. La documentation de Pangram 4 distingue d’ailleurs les segments « rédigés par un humain », « assistés par IA » et « générés par IA ». (pangram.com)
La vérification
Un détecteur n’est pas dépourvu d’intérêt, mais ses performances doivent être rapportées à ce qu’il a effectivement été testé sur. Une étude publiée en juin 2026 a comparé Pangram à trois autres outils sur 160 textes universitaires en anglais dont l’origine était connue. Pangram y obtenait les meilleurs résultats des outils étudiés. Les chercheurs précisent cependant que cette expérience, menée sur des textes longs et académiques, ne reproduit pas toutes les conditions réelles de rédaction ; leur second corpus, composé de mémoires authentiques, ne disposait pas d’une origine vérifiée permettant de contrôler chaque détection. Ces résultats ne valident donc pas automatiquement un score appliqué à un article de presse français particulier. (link.springer.com)
Autre point décisif pour reproduire le test : la version de Pangram. Le fournisseur indique que Pangram 4 était disponible depuis le 29 juillet 2026, mais que la version 3.3.2 restait celle utilisée par défaut dans son interface de programmation jusqu’au 30 septembre 2026, sauf sélection explicite de la version 4. Les résultats d’un nouveau passage dans l’outil ne seraient donc pas nécessairement comparables sans connaître la version employée par CheckNews. (pangram.com)
Nous n’avons pas pu accéder au texte intégral de l’enquête de Libération ni reproduire ses 50 analyses. Les éléments consultables ne donnent pas la liste des articles, leurs dates, les textes soumis, les scores individuels, les réglages utilisés ou le mode de sélection de l’échantillon. Nous ne pouvons donc ni auditer indépendamment le décompte de 37 articles, ni déterminer si ces 50 textes représentent la production du site. Cette limite ne démontre pas que le résultat de CheckNews est erroné ; elle empêche de le présenter ici comme un constat vérifié une seconde fois.
Les sources et les données
Cette vérification s’appuie sur l’affirmation chiffrée publiée par CheckNews, sur la documentation technique et les explications de Pangram concernant ses scores et ses versions, ainsi que sur une évaluation scientifique indépendante du détecteur. Ces sources éclairent ce que le test peut signifier. Elles ne fournissent pas, à elles seules, l’historique de rédaction des articles de Frontières. (collector.com.tr)
Verdict
Verdict : impossible à confirmer. Le chiffre de 37 articles sur 50 est un résultat rapporté par CheckNews, que nous n’avons pas pu recalculer. Même s’il était reproduit, un score de détection resterait un indice de contenu généré ou assisté par IA, et non une observation directe des méthodes de travail de Frontières. Affirmer sans cette réserve que le média recourt « fortement » à l’IA pour l’ensemble de son site irait au-delà des éléments vérifiables ici.
Ce qu’il faut retenir
La question mérite une enquête ; le score d’un logiciel ne remplace pas, à lui seul, la connaissance des textes testés, de la méthode d’échantillonnage et des étapes de rédaction. La distinction est simple : 37 détections annoncées dans un échantillon ne sont pas 37 processus de rédaction établis.
Source principale : Libération (www.liberation.fr)
Article original : Consulter la source originale
Auteur : Jacques Pezet
