La question revient de plus en plus souvent, et de deux directions très différentes. Certains auteurs ont travaillé avec un modèle de langage et veulent savoir si cela se voit. D’autres n’y ont jamais touché et craignent pourtant que leur texte soit refusé parce qu’il « semble écrit par une machine ». Les deux inquiétudes sont compréhensibles, car de plus en plus de maisons d’édition, d’agents et de concours d’écriture passent les textes reçus au scanner de contenu généré automatiquement avant qu’un humain ne les lise.
La mauvaise nouvelle : il n’existe aucun test fiable et définitif qui dirait une fois pour toutes « ceci a été écrit par un humain ». La bonne nouvelle : dès que vous comprenez ce que ces détecteurs mesurent réellement et à quel point ils peuvent être peu fiables, vous cessez de les craindre et vous faites la seule chose qui aide vraiment : écrire pour que le texte sonne comme vous.
Réponse courte : un détecteur n’établit pas la « vérité » sur l’auteur d’un texte, il mesure la forme statistique de la prose, et il se trompe souvent, surtout sur un texte propre, lisse, un peu formel. Un verdict du type « ce texte semble écrit par une machine » n’est pas une preuve. Au lieu de chercher un détecteur miracle, analysez le texte vous-même, repérez les passages qui sonnent mécaniques et réécrivez-les avec votre propre voix.
Ce que « semble écrit par une machine » veut vraiment dire
Un détecteur ne comprend pas votre histoire. Il ne sait pas si votre protagoniste convainc ni si votre fin tient. Il mesure la forme statistique de la prose : la prévisibilité de chaque mot suivant, la régularité du rythme des phrases, la fréquence à laquelle vous recourez aux mêmes constructions, le peu de surprise que contient un passage. Un texte généré par une machine est en général lisse, régulier dans son rythme et pauvre en surprises, et le détecteur compte donc cette régularité comme un signal.
Il en découle deux choses. D’abord, le détecteur juge un style, pas une honnêteté. C’est pourquoi votre propre prose, soignée et correcte, peut obtenir un mauvais score alors que vous avez écrit chaque mot vous-même. Ensuite, ce que l’on présente comme les « marques du texte généré » (les mots favoris des modèles de langage, les énumérations bien alignées, les transitions toutes faites) relève de l’observation stylistique, pas d’un test fiable. Parfois ces marques sont justes, parfois elles induisent en erreur, et elles évoluent avec chaque nouvelle version d’un modèle. Traitez-les comme des indices, pas comme un verdict.
Pourquoi les détecteurs se trompent plus souvent que vous ne le pensez
Ce n’est pas une hypothèse prudente, c’est le résultat d’une recherche évaluée par des pairs. Une équipe de Stanford (Liang et al., 2023, dans la revue Patterns de Cell Press) a soumis à sept détecteurs populaires des essais rédigés par des personnes dont l’anglais n’est pas la langue maternelle. Le résultat devrait refroidir quiconque voit dans ces outils un oracle : les détecteurs ont classé à tort ces essais humains comme générés automatiquement dans 61,3 % des cas en moyenne. Pire encore : 89 essais sur 91, soit 97,8 %, ont été signalés comme texte de machine par au moins un des sept détecteurs. À titre de comparaison, pour les textes d’auteurs de langue maternelle anglaise, la part de fausses alertes était bien plus faible.
La conclusion est double. D’une part, ces outils ont un taux de faux positifs réel et élevé. D’autre part, ils sont biaisés : ils frappent le plus durement ceux qui écrivent de façon plus simple, plus régulière, plus « scolaire », et ce sont souvent justement des personnes qui apprennent encore le métier ou qui écrivent dans une autre langue que leur langue maternelle. Si un détecteur signale un jour votre texte, souvenez-vous de ce chiffre. Le verdict d’un seul outil n’est pas une preuve, c’est une estimation avec une grande marge d’erreur.
Comment vérifier votre propre texte avec discernement
Comme chaque détecteur pris isolément peut se tromper, ce qui compte, c’est la méthode, pas la foi en un seul outil.
- Analysez d’abord l’ensemble pour avoir un point de départ. Un chiffre pour tout le livre vous dit si vous avez un problème localisé ou un problème réparti uniformément.
- Passez ensuite chapitre par chapitre. Les passages qui sonnent mécaniques sont en général regroupés. Un chapitre écrit à la hâte, ou avec l’aide d’un outil, ressort souvent du lot.
- Lisez les phrases au score le plus bas, pas seulement le chiffre. Un bon détecteur vous désigne des phrases précises. Ces phrases forment votre liste de révision, pas le pourcentage affiché en haut de l’écran.
- Réécrivez-les avec vos propres mots. Cassez le rythme trop régulier, supprimez le remplissage, remplacez les formulations générales par quelque chose de propre à votre histoire. Relancez ensuite l’analyse et vérifiez que le passage sonne désormais comme le reste du livre.
- N’entrez pas en compétition avec le détecteur. Le but n’est pas de « battre » l’outil, mais de faire en sorte que le texte sonne vraiment comme vous, avant que quelqu’un d’autre n’en décide.
Que changer, concrètement, quand un passage sonne mécanique ? En général, la même chose que ce que vous corrigeriez de toute façon en révision : variez la longueur des phrases, supprimez les tournures passives et les verbes passe-partout, ajoutez un détail concret que seul votre personnage connaît. Ce n’est pas jouer avec un détecteur, c’est simplement une meilleure prose. Nous en parlons à part dans l’article sur la voix passive dans la prose.
Un détecteur pour romanciers, pas pour dissertations
La plupart des détecteurs que l’on trouve en ligne sont conçus pour les dissertations, les articles et les devoirs. Ils sont généralistes, calculent souvent leur score au niveau des mots isolés et traitent un roman de 90 000 mots comme un gigantesque bloc de texte à coller. Ils ne sont pas pensés pour la fiction, pour le découpage en chapitres ni pour la façon dont un romancier réécrit réellement.
Les logiciels d’écriture ont le problème inverse : ceux qui sont centrés sur la génération de texte n’ont, pour des raisons évidentes, aucun détecteur. La plupart des auteurs se retrouvent donc à choisir entre un outil qui aide à écrire et un vérificateur séparé et généraliste, qui n’a jamais été pensé pour les livres. Vellam intègre le détecteur : il indique, chapitre par chapitre ou pour tout le livre, à quel point la prose sonne mécanique, et surligne les phrases au score le plus bas pour que vous puissiez les réécrire avec vos propres mots. C’est le détecteur gratuit conçu spécialement pour les écrivains, pas un scanner généraliste de dissertations, et c’est précisément pour cela qu’il fonctionne le mieux pour les romanciers. Il prend aussi en charge les manuscrits en français. À côté, une couche stylistique gratuite fondée sur des règles vous aide à améliorer ces phrases (pour l’instant en polonais, anglais, allemand et espagnol). C’est une manière de vous rassurer, vous, l’auteur, pas une porte dont quelqu’un d’autre détiendrait la clé. Pour en savoir plus sur l’analyse avant l’envoi, lisez l’article complémentaire sur la vérification de votre roman avant de le soumettre.
Retenez une chose : le détecteur intégré, lui aussi, donne une estimation, pas un oracle. Le score seul ne décide de rien. La valeur ne réside pas dans le pourcentage, mais dans les phrases surlignées sur lesquelles vous pouvez travailler.
Ce qu’il vaut mieux éviter
Pour finir, trois pièges dans lesquels on tombe facilement dès que l’on craint que son texte paraisse mécanique.
Ne réécrivez pas tout votre livre pour obtenir un score
Si un détecteur donne un pourcentage élevé mais que le texte est bien de vous, le problème vient de l’outil, pas du texte. Lisez les phrases signalées et jugez-les vous-même.
Ne vous fiez pas à un seul détecteur
Avec 61 % de fausses alertes sur de la prose humaine, un verdict isolé ne décide de rien. Comparez tout au plus quelques détecteurs et lisez les passages concrets.
Ne confondez pas fluidité et culpabilité
Une phrase propre et régulière n’est pas la preuve d’une machine. Parfois, c’est simplement une phrase propre. Modifiez-la parce qu’elle se lit de façon impersonnelle, pas parce qu’un outil s’allume en rouge.
Questions fréquentes
Les détecteurs de texte généré sont-ils fiables ?
Seulement en partie. Une recherche de Stanford évaluée par des pairs, publiée en 2023, a montré que des détecteurs populaires classaient à tort des essais humains comme générés automatiquement dans 61,3 % des cas en moyenne, et que 97,8 % des textes étaient signalés par au moins un des sept détecteurs. Le verdict d’un seul outil est une estimation avec une grande marge d’erreur, pas une preuve de l’identité de l’auteur.
Comment savoir si un texte se lit comme s’il avait été écrit par une machine ?
Les détecteurs réagissent à la forme statistique de la prose : une forte prévisibilité des mots, un rythme de phrase régulier, des constructions répétées et peu de surprise. Ce que l’on appelle les « marques du texte généré » relève de l’observation stylistique et non d’un test fiable, et ces marques changent avec chaque nouvelle version d’un modèle. Voyez-les comme des indices et fondez votre décision sur la question de savoir si un passage sonne comme vous.
Mon texte peut-il être signalé comme texte de machine alors que je l’ai écrit moi-même ?
Oui, et cela arrive souvent. Les détecteurs frappent le plus durement ceux qui écrivent de façon plus simple, plus régulière et plus formelle, dont les personnes qui apprennent le métier et les auteurs qui n’écrivent pas dans leur langue maternelle. Un faux signalement ne signifie pas que vous avez mal fait quelque chose, mais que l’outil se trompe.
Comment améliorer un passage qui sonne mécanique ?
En général comme vous l’amélioreriez en révision : variez la longueur des phrases, supprimez les verbes passe-partout et les tournures passives, ajoutez un détail concret tiré de votre propre histoire et cassez le rythme trop régulier. Le but n’est pas de battre le détecteur, mais de faire sonner la phrase comme le reste de votre livre.