Human writing mixes short sentences with long ones. Machine drafts tend toward a uniform middle length. Higher variation reads more naturally.
Sentence lengths: 20, 8, 12, 14
Long average sentences make prose heavy regardless of who wrote it. Around 15-20 words reads comfortably; past 25 the reader starts working.
A small set of words appears far more often in generated text than in human writing. Their density is the single most visible tell.
delve · leveraging · robust · seamless · crucial · myriad · facilitate · landscape · underscores · embark · holistic · comprehensive
Phrases like "it is important to note that" add words without adding meaning. Cutting them shortens the text and sharpens it.
it is important to note · In today's fast-paced world
Models punctuate with em dashes several times more often than people typing on a keyboard, where the character is awkward to reach.
Sentences that begin Moreover, Furthermore, Additionally are connective throat-clearing. A few are fine; a pattern of them is a tell.
Moreover, leveraging robust frameworks is crucial for success. · Furthermore, this seamless approach will facilitate numerous outcomes … · Additionally, organisations should embark on a holistic transformation…

Cet outil mesure les modèles d'écriture qui font lire la prose comme générée par machine, et rapporte à chacun les preuves derrière. Il ne génère pas de pourcentage de chances qu'un modèle ait écrit votre texte, car ce nombre ne peut pas être produit honnêtement et le mal de le produire de toute façon est réel.
Voici le problème avec les détecteurs d'IA Ce sont des classificateurs statistiques devinant la paternité à partir de caractéristiques de surface, et ils sont assez peu fiables pour qu'OpenAI retire les siens pour une faible précision Leurs faux positifs tombent le plus fort sur les gens écrivant dans une langue seconde, dont la prose est mesurablement plus régulière et ressemble donc plus à une machine à un classificateur Un « 87 % IA-généré » d'apparence confiante s'habitue à accuser un étudiant ou à rejeter un pigiste, et il n'y a rien en dessous qui puisse supporter ce poids Tout outil qui vous montre un tel nombre vous invite à prendre une décision conséquente sur un tirage au sort.
Ce qui peut être mesuré honnêtement est le texte lui-même La variation de longueur de phrase, généralement appelée éclat, est le signal unique le plus fort : l'écriture humaine mélange une phrase de trois mots avec une de trente mots, tandis que les brouillons de machine s'installent dans une longueur moyenne uniforme La densité du vocabulaire compte la fréquence à laquelle le texte atteint pour le petit ensemble de mots modèles de surutilisation La densité de haies compte des phrases comme « il est important de noter que » qui ajoutent de la longueur sans signification Le taux de tiret Em compte un caractère que les modèles produisent plusieurs fois plus souvent que quelqu'un qui tape Les ouvreurs de connexions comptent les phrases qui commencent par Plus ou Par ailleurs.
Chacun de ceux-ci est un fait sur l'écriture plutôt qu'une affirmation sur l'écrivain, et chacun est rapporté avec les correspondances qui l'ont produit, de sorte que vous pouvez vérifier la mesure plutôt que de lui faire confiance Cela rend le résultat utile pour la chose pour laquelle il est réellement bon : édition. La faible variation et la couverture lourde rendent la prose pire quel que soit celui qui l'a écrit, et les deux sont fixables.
Utilisez-le pour diagnostiquer vos propres brouillons, pour voir quelles parties d'un document se lisent comme des formules, et pour comprendre quels sont les motifs Ne l'utilisez pas, et ne laissez personne l'utiliser, pour décider si une personne dit la vérité sur son propre travail Tout s'exécute dans votre navigateur ; rien n'est téléchargé, enregistré ou stocké.
Toute prose - une ébauche, un article, une soumission Elle reste dans votre navigateur et n'est jamais téléchargée.
Six mesures, chacune avec sa valeur, une explication en anglais simple et les correspondances qui l'ont produite.
Chaque signal répertorie ce qu'il correspond réellement Si un décompte semble faux, les preuves vous expliquent pourquoi.
La faible variation et la forte couverture aggravent l'écriture de celui qui l'a écrite Envoyez le texte à l'humanisateur, ou modifiez à la main.
Signalé comme un coefficient de variation, il ne dépend donc pas de la longueur absolue Le signal unique le plus fort de l'ensemble.
Compte environ 40 mots que les modèles atteignent pour 1 000 mots constamment normalisés, donc les textes courts et longs se comparent.
Phrases qui ajoutent de la longueur sans signification et phrases qui commencent par un dégagement conjonctif de la gorge, toutes deux répertoriées par correspondances.
Chaque signal affiche les correspondances réelles ou les longueurs brutes des phrases, de sorte qu'une mesure peut être vérifiée plutôt que crue.
Rewrite the habits that make prose read as machine-written - inflated vocabulary, hedge phrases, em dashes, and connective filler.
Detect and remove invisible Unicode characters from AI text - zero-width joiners, variation selectors, bidi controls, and tag characters.
Generate random numbers in any range, with unique-only and decimal options.
Count words, letters, sentences, paragraphs, and estimate reading time
0 comments
No comments yet. Be the first to share your thoughts!