Les détecteurs de texte généré (GPTZero, Turnitin) affichent de bons résultats en laboratoire : 98 à 100 % de fiabilité sur un texte brut. Mais leur performance s'effondre dès que le texte passe dans un outil d'« humanisation » : moins de 74 %. Une simple reformulation suffit souvent. Des chefs d'établissement alertent : « avec cette version de ChatGPT, on ne peut même plus le détecter ».
Le second problème est plus grave que le premier. Ces détecteurs produisent des faux positifs qui accusent des élèves innocents, et ces erreurs ne sont pas réparties au hasard : elles touchent particulièrement les locuteurs non natifs, dont l'écriture plus simple ressemble statistiquement à celle d'un modèle (Liang et al., Patterns, 2023).
Le ministère de l'Éducation nationale a d'ailleurs tranché : le cadre d'usage de juin 2025 demande explicitement d'éviter d'utiliser des logiciels de détection de contenus générés par l'IA, « peu fiables », car « ils pourraient conduire à pénaliser à tort un élève ». Un outil facile à contourner pour qui triche, et injuste pour une partie de ceux qui ne trichent pas, ne peut pas fonder une politique d'établissement. La réponse pédagogique passe par la refonte des modalités d'évaluation — oral, travaux en présentiel, processus rendu visible plutôt que produit final — et par un dialogue transparent sur ce qui est autorisé.