GPT, Claude, ou moi ? … Les nouveaux soupçons sur nos écrits
En mai 2026, ma petite-fille, alors en première au lycée, a rendu un devoir rédactionnel. Elle l'avait travaillé. Le texte était bon, vraisemblablement trop bon. Elle a obtenu une mauvaise note parce qu'elle était soupçonnée d'avoir utilisé une intelligence artificielle. Bien sûr, elle ne l'avait pas fait.
L'incident aurait pu rester anecdotique. Il ne l'a pas été. Ma petite-fille est une bonne élève et elle lit beaucoup. Elle en a tiré une conclusion aussi simple qu'inquiétante : mieux vaut rendre un devoir moyen et obtenir une note moyenne que produire un excellent texte et risquer d'être soupçonnée de tricher. Depuis, elle bride volontairement son écriture.
J'ai repensé à cette histoire récemment. Sous l'un de mes articles, quelqu'un avait laissé ce commentaire : « Article nul, généré par l'IA. »
Je ne cache pourtant pas mon utilisation de l'intelligence artificielle. Je travaille aujourd'hui avec GPT, Claude, Mistral, Gemini, Canva et je pourrais demain travailler avec d'autres outils. Ce n'est donc pas l'accusation qui m'avait touché, ni la critique : publier, c'est accepter d'être critiqué. C'est qu'en cinq mots, ce commentaire effaçait tout le travail qui se trouvait derrière.
Mes articles partent de mes interrogations, de mon expérience et de ce que je souhaite transmettre. L'IA m'aide à les structurer, à supprimer des répétitions, à corriger des fautes et parfois à trouver une formulation plus claire. Elle améliore mon écriture. Elle ne décide pas de ce que je pense.
Avant l'IA, j'écrivais déjà comme cela
Deux caractéristiques de mes articles alimentent régulièrement le soupçon : leur longueur et leur caractère pédagogique.
Il suffit pourtant de relire ce que je publiais avant ChatGPT. Mes textes étaient déjà longs, détaillés et soucieux d'expliquer. On me le reprochait d'ailleurs dans les mêmes termes : « c'est trop long », « tu expliques trop ».
Ce que l'IA a changé, c'est principalement la finition et l'organisation, pas ma manière de transmettre. C'est aussi pour cette raison que l'affaire Thélyson Orélien m'a interpellé.
Quand le soupçon devient une affaire littéraire
Le 25 septembre dernier, l'Académie Goncourt a retiré de sa sélection « C'était ça ou mourir », de Thélyson Orélien. Elle estime, en s'appuyant sur plusieurs analyses de chercheurs et de journalistes, que le roman est « selon toute vraisemblance très largement le produit d'une intelligence artificielle ». L'auteur conteste avoir utilisé l'IA pour l'écrire. Il fait par ailleurs l'objet d'accusations de plagiat concernant des textes d'opinion antérieurs, et non le roman lui-même.
Je ne sais pas comment ce livre a été écrit et je ne peux donc pas juger de la réalité de l'utilisation d'une IA. Mais cette affaire pose, à l'échelle d'un grand prix littéraire, une question qui me touche directement : comment déterminons-nous aujourd'hui la part de l'humain et celle de l'IA dans un texte ?
J'ai voulu faire une expérience. Et, cette fois, j'avais un avantage : je connaissais l'histoire du texte analysé.
Cinq services, quatre moteurs, un même texte
J'ai écrit un article consacré à l'intelligence artificielle, 615 mots, pas encore publié. Je l'ai volontairement élaboré avec GPT et Claude, parce que j'expérimente depuis quelque temps cette méthode de travail en tandem.
L'idée, les interrogations et le raisonnement de départ sont les miens. GPT m'a aidé à construire et rédiger le texte. Claude l'a ensuite critiqué et en a proposé une version plus courte. J'ai confronté leurs propositions, demandé de nouvelles modifications, rejeté certaines formulations, conservé d'autres et arbitré la version finale.
Je ne peux pas dire : « 40 % Thierry, 35 % GPT et 25 % Claude ». Cela n'aurait aucun sens.
En revanche, je connais la genèse du texte. Je sais ce que j'ai apporté, ce que j'ai demandé aux IA, les propositions que j'ai retenues ou refusées, et pourquoi la version finale est celle-là. C'est donc un texte humain assisté par deux IA, et je suis le seul à en connaître la genèse complète.
Les détecteurs, eux, n'ont pas eu ce scrupule. Je leur ai soumis le texte sans changer un mot.
· JustDone affiche 95 % de contenu IA.
· Originality ai le classe « Likely AI », avec 99 % de confiance, et précise que le seuil de 15 % d'utilisation d'IA sélectionné est dépassé.
· QuillBot affiche 0 % IA et 100 % humain.
· GPTZero estime les probabilités à 9 % IA, 21 % mixte et 70 % humain, tout en se disant modérément confiant que le texte est entièrement humain.
· Enfin, Scribbr affiche lui aussi 0 % IA et 100 % humain, mais ce cinquième résultat n'est pas indépendant : au moment du test, Scribbr utilisait le moteur QuillBot v6.2.1.
👉 D'un côté, 95 % IA. De l'autre, 100 % humain.
Ces outils ne mesurent pas tous exactement la même chose, et leurs chiffres ne peuvent pas être comparés comme des mesures physiques de la quantité d'IA présente dans un texte. GPTZero est d'ailleurs le seul à faire apparaître une composante mixte, à hauteur de 21 %, même si sa conclusion globale considère le texte comme probablement humain. Aucun résultat ne restitue donc réellement ce que je sais de sa fabrication : une rédaction humaine assistée, à plusieurs étapes, par deux intelligences artificielles.
Détecter n'est pas établir une provenance
Un détecteur analyse un produit fini et recherche des régularités statistiques. Il ne connaît ni mes réflexions de départ, ni mes échanges avec GPT et Claude, ni les propositions que j'ai rejetées, ni les raisons de mes choix. Il analyse un résultat. Il ne reconstitue pas son histoire.
Cela ne signifie pas que ces outils soient inutiles. Mais leur résultat constitue un indice, pas à lui seul une preuve de provenance. QuillBot le reconnaît d'ailleurs dans son interface, en recommandant de ne jamais fonder sur son seul résultat une décision susceptible d'affecter les études ou la carrière d'une personne.
Mon expérience a également ses limites. Un article de 615 mots n'est pas un roman. Je n'ai pas testé Pangram, l'outil qui a joué un rôle particulier dans le déclenchement de l'affaire Orélien. Mon test ne dit donc rien de la manière dont ce roman a été écrit. Il permet seulement de constater quelque chose de plus modeste :
👉 sur un texte dont je connais la genèse, plusieurs détecteurs arrivent à des conclusions radicalement différentes.
Et derrière un soupçon erroné, quelle qu'en soit l'origine, il y a une personne. Ma petite-fille en a fait l'expérience : elle a appris qu'un texte trop bien construit pouvait devenir suspect.
Et le prête-plume ?
Depuis longtemps, des personnalités publient des ouvrages rédigés en tout ou partie avec l'aide d'un prête-plume (ghostwriter en anglais). Elles fournissent leurs souvenirs, leurs idées ou leur expertise ; un professionnel les aide à les transformer en livre. Pourquoi l'intervention d'une IA nous paraît-elle différente ?
Une partie de la réponse tient probablement au pacte de lecture. Dans des mémoires ou un témoignage, nous pouvons accepter qu'un professionnel ait participé à la mise en forme. Dans un roman présenté à un prix littéraire, l'écriture elle-même fait partie de ce que le lecteur et le jury viennent apprécier.
Mais surtout, « utiliser l'IA » ne décrit presque rien. Demander « écris-moi un roman de 300 pages sur ce thème » n'est pas équivalent à « j'ai écrit ce chapitre, signale-moi les répétitions et propose-moi une formulation plus claire ». Entre les deux existent la correction, la recherche documentaire, la traduction, le résumé, la recherche d'idées, la structuration, la reformulation, la rédaction partielle et la génération presque complète.
La frontière entre assistance et substitution mérite donc d'être discutée. Un détecteur, lui, ne peut pas la tracer à notre place.
Faudra-t-il bientôt certifier que l'on est humain ?
Récemment, un reportage de LCI consacré à l'IA se concluait par cette question : faut-il désormais préciser qu'un texte a été écrit par un humain ? Le chroniqueur évoquait un label « 100 % humain ». Il existe déjà. Aux États-Unis, l'Authors Guild délivre depuis 2025 une certification « Human Authored ». En France, les éditions de l'Observatoire ont lancé le 25 septembre, en pleine affaire Orélien, un label « Livre sanctuaire, 100 % humain », dont le premier titre paraît le 1er octobre.
Ma première réaction a été l'agacement. Faudra-t-il aussi préciser que j'ai écrit ce texte sur un ordinateur, avec un traitement de texte et un correcteur orthographique ? Enfant, j'ai appris à écrire à la plume Sergent-Major, avec un buvard pour éviter les taches. Personne ne m'a jamais demandé de certifier que mes écrits n'avaient pas été tapés à la machine.
La comparaison a ses limites, et je préfère le reconnaître : un traitement de texte ne propose pas de phrases, une IA générative, si. Les labels existants tiennent d'ailleurs compte de cette différence. Ils tolèrent le correcteur orthographique ou l'aide à la recherche, pourvu que le texte lui-même soit écrit par un humain.
Ce qui me gêne est ailleurs. D'abord, le renversement de la charge : c'est désormais à l'humain de prouver qu'il l'est. Ensuite, le caractère binaire de l'étiquette. Un label « 100 % humain » ne connaît que deux cases, alors que les usages forment un dégradé. Mon texte n'entrerait pas dans la première. Faut-il pour autant le ranger dans la seconde, avec les livres générés à la chaîne ?
Ces labels rejoignent pourtant mon propos sur un point essentiel. L'Observatoire a choisi de ne pas recourir aux détecteurs : son label repose sur l'engagement de l'auteur. Ce n'est pas une détection, c'est une déclaration. Reste à inventer celle qui décrirait honnêtement tout ce qui se trouve entre les deux cases.
Qui a écrit l'article que vous venez de lire ?
L'histoire de ma petite-fille, je l'ai vécue à ses côtés. Le commentaire, c'est sous mon article qu'il a été posté. L'idée de cette expérience vient de mes interrogations, et j'ai réalisé moi-même les tests.
Pour la rédaction de cet article, j'ai procédé comme pour celui soumis aux détecteurs. J'ai écrit un brouillon avec mes idées, ma prose, le sens que je donne aux mots et ma volonté de transcrire ce que je ressens. GPT a rédigé une première version, Claude l'a critiquée et en a proposé une autre. J'y ai ajouté les expériences personnelles que vous venez de lire. GPT et Claude se sont ensuite relayés, l'un réécrivant, l'autre critiquant, sur plusieurs versions successives. Et, à chaque étape, j'ai décidé de la direction à prendre.
Je revendique donc ce texte parce que j'en porte le propos, que j'ai choisi ce qui devait y figurer et que j'en assume la responsabilité. Je ne prétendrai pas pour autant l'avoir produit sans assistance.
La question « ce texte a-t-il été produit avec une IA ? » reste légitime dans certaines situations. Mais elle ne suffit plus. Il faut aussi demander comment l'IA a été utilisée, quelle part du travail lui a été confiée, qui a décidé de la version finale et qui assume ce qui est publié.
Aucun score ne répondra à toutes ces questions. Un détecteur peut essayer de deviner comment un texte a été fabriqué. La transparence, elle, ne se détecte pas : elle se déclare.
Thierry Mohr

Commentaires
Réagir à cet article
Votre adresse e-mail ne sera pas publiée. Elle sert uniquement à confirmer votre contribution avant modération.
Commentaires publiés
Seuls les commentaires validés après vérification de l'adresse e-mail et modération sont affichés ici.