À propos de cet outil
Les détecteurs d'écriture IA — même commerciaux — restent un problème réellement difficile et non résolu. Cette page n'exécute pas de modèle de détection entraîné. Elle calcule à la place quatre statistiques textuelles simples et transparentes que la recherche associe (faiblement) au texte généré par machine : la variation de la longueur des phrases (irrégulière ou uniforme), la diversité du vocabulaire sur des fenêtres glissantes de 100 mots, la fréquence de répétition de phrases exactes de 4 mots, et la variation de la longueur des mots au sein des phrases. Chacune est affichée séparément, avec un score combiné de 0 à 100, afin que vous voyiez exactement pourquoi le chiffre est ce qu'il est, plutôt que de faire confiance à un verdict opaque.
Aucun de ces quatre signaux n'est, à lui seul, une empreinte fiable d'une rédaction par IA, pas plus que leur moyenne. Des rédacteurs humains soigneux peuvent produire une prose très uniforme et peu diversifiée (documentation technique, textes juridiques standardisés, écrits de locuteurs non natifs) qui obtient ici un score « ressemblant à l'IA », et un texte IA légèrement édité peut facilement briser les quatre schémas. Utilisez ceci comme une vérification intuitive, approximative et transparente d'un texte — un point de départ de discussion, pas un verdict — et jamais comme preuve dans une affaire d'intégrité académique, une décision d'embauche, ou toute autre chose ayant de réelles conséquences pour quelqu'un.
Questions fréquentes
Cela peut-il prouver qu'un texte a été écrit par une IA ?
Non, et c'est la chose la plus importante à comprendre à propos de cet outil : il calcule 4 statistiques textuelles simples (variance de longueur des phrases, diversité du vocabulaire, répétition de phrases, variance de longueur des mots) et les combine en un score — il ne contient aucun modèle de langage entraîné. Même les détecteurs d'IA commerciaux sophistiqués avec de vrais modèles de ML ont des taux connus de faux positifs/négatifs ; une heuristique statistique artisanale est nettement plus faible encore. N'utilisez jamais cela comme preuve dans un cas d'intégrité académique, une décision d'embauche, ou toute autre chose conséquente.
Pourquoi un texte humain pourrait-il être noté comme « ressemblant à de l'IA » ?
Les signaux sous-jacents que cet outil mesure (longueurs de phrases uniformes, diversité de vocabulaire plus faible, formulations répétées) peuvent aussi apparaître dans beaucoup d'écrits humains ordinaires — documentation technique, texte juridique, rédacteurs anglophones non natifs qui privilégient des structures de phrases plus simples et répétitives, ou même simplement le style naturel d'un rédacteur soigneux et méthodique. Aucun de ces signaux n'a été conçu pour être une preuve définitive de quoi que ce soit ; ce sont des corrélations statistiques faibles, pas des marqueurs causaux de paternité. C'est exactement pourquoi l'outil montre son travail (les 4 sous-scores individuellement) au lieu de se cacher derrière un seul chiffre opaque.