De eerste keer dat ik een van mijn eigen blogposts door een woordfrequentieteller liet lopen, voelde ik me een beetje blootgelegd Ik had het woord & quot; basically" veertien keer gebruikt in een artikel van 1200 woorden Not " occasionally" veertien keer Veertien keer Mijn ogen hadden tijdens het schrijven over elk ervan heen gedoofd, want dat is precies wat krukwoorden doen: ze verbergen zich in het volle zicht Een frequentietelling geeft niets om je bedoelingen Het telt gewoon, en het getal staat daar op het scherm en daagt je uit om er ruzie mee te maken.
Ik bouw tools bij [Toolz.dev] (/, en ik besteed het grootste deel van mijn week aan schrijven: documentatie voor WordPress plugins, marketing copy, Laravel tutorials, release notes Woordfrequentie analyse is stilletjes een van de controles geworden die ik voer voordat er iets wordt verzonden Het is een dertig seconden pass die herhaling vangt mijn hersenen weigert te zien, bevestigt dat een pagina daadwerkelijk het onderwerp vermeldt waar het over beweert te gaan, en mij af en toe redt van het publiceren van iets dat leest alsof het is samengesteld uit drie verschillende concepten Deze gids is alles wat ik heb geleerd over het tellen van woorden goed.
tl;dr: Een woordfrequentieteller splitst uw tekst in woorden en rapporteert hoe vaak ze allemaal voorkomen, gerangschikt van meest naar minst gebruikelijk Gebruik het om overgebruikte krukwoorden op te vangen, controleer de dichtheid van zoekwoorden voor SEO en begrijp wat een document daadwerkelijk benadrukt Vouw geval zo & quot; The" en "the" tellen samen, schakel het stopwoordfilter in om functiewoorden als "the" en " en " en lees de procentuele kolom om elk woord' het deel van de tekst te zien De Woord frequentieteller draait volledig in uw browser, dus er wordt niets geüpload dat u plakt.
Wat is een woordfrequentieteller?
Een woordfrequentieteller leest een tekstblok en verdeelt het in individuele woorden - een stap Unicode Standaardbijlage #29 specificeert veel zorgvuldiger dan " split op spaties" suggereert - en vertelt u hoe vaak elk afzonderlijk woord voorkomt De uitvoer is een gerangschikte tabel: elk uniek woord, zijn telling en meestal zijn percentage van het hele document Het woord dat het vaakst verschijnt, staat bovenaan.
Dit is een andere vraag dan de vraag die een gewone woordenteller beantwoordt. A woordenteller vertelt u dat een document 847 woorden heeft Een frequentieteller vertelt u dat 31 van die woorden & quot; the, & quot; 12 are & quot; data, & quot; and 9 are & quot;echter." Het totaal is één getal over lengte De frequentietabel is een verdeling over nadruk Lengte vertelt u of u een toewijzingsdoel raakt Distributie vertelt u waar het schrijven eigenlijk over gaat en waar het zich herhaalt.
Het begrip is oud en goed bestudeerd Taalkundigen meten al meer dan een eeuw woordfrequenties, en het patroon dat naar voren komt is opmerkelijk consistent in alle talen: een klein aantal woorden neemt een enorm deel van elke tekst voor zijn rekening, en de frequentie daalt daarna scherp Dit is de wet van Zipf' de observatie dat het meest voorkomende woord de neiging heeft om ongeveer twee keer zo vaak voor te komen als het op een na meest voorkomende, drie keer zo vaak als het derde, enzovoort, Je zult deze vorm in je eigen schrijven zien op het moment dat je een document sorteert op frequentie De bovenkant van de lijst wordt gedomineerd door korte functiewoorden, en de interessante inhoudswoorden lopen erachter.
Waarom zou ik de woordfrequentie tellen?
Ik grijp naar frequentieanalyse om vier verschillende redenen, en het helpt om te weten welke je achtervolgt voordat je de tabel leest.
De eerste is het vangen van herhaling Elke schrijver heeft krukwoorden, degene waar ze op leunen zonder het te merken De mijne zijn & quot; in principe, & quot; & quot; eigenlijk, & quot; en & quot;just." De jouwe zou & quot; echt kunnen zijn, & quot; & quot;very, & quot; of een bepaalde technische term waar je verliefd op bent geworden Herhaling is van binnenuit onzichtbaar omdat je elke instantie op een apart moment hebt geschreven en ze nooit hebt zien opstapelen Een frequentietelling stapelt ze op.
De tweede is trefwoorddichtheid voor zoeken Wanneer ik een pagina schrijf die gericht is op een specifieke zin, wil ik de zin bevestigen en de nauwe varianten ervan verschijnen vaak genoeg zodat een zoekmachine het onderwerp begrijpt, zonder zo vaak te verschijnen dat de pagina als gevuld leest. De procentuele kolom verandert dit van een vage zorg in een getal dat ik kan controleren.
De derde is het begrijpen van een onbekend document Plak in een lang rapport, een transcript, of een concurrent' s artikel, sorteer op frequentie, filter de functiewoorden eruit, en de bovenkant van de lijst is een eerlijke samenvatting van het onderwerp in ongeveer tien seconden Het is een ruwe samenvatting, maar het is snel en eerlijk.
De vierde is bewerken voor variatie Als & quot; important" elf keer voorkomt, zijn sommige daarvan kandidaten voor een synoniem of voor verwijdering. De telling vertelt je niet welke je moet veranderen, maar zegt dat je moet zoeken.
Hoe gebruik ik de Word Frequency Counter?
De workflow is kort Plak je tekst in het invoervak op de Woord frequentieteller, en de gerangschikte tabel verschijnt onmiddellijk Er is geen uploadstap en geen knop om op te wachten voor de basistelling.
Van daaruit geven de opties vorm aan wat u ziet Bepaal of hoofdletter er toe doet Voor het meeste schrijven wilt u hoofdlettervouwen, de standaardinstelling, zodat "Data, & quot; & quot; data, & quot; en & quot; DATA" tellen als één woord in plaats van drie Schakel het stopwoordfilter in wanneer u wilt dat de rangschikking inhoudswoorden boven water zet in plaats van grammatica Stel een minimale woordlengte in om zeer korte tokens over te slaan En als de staart van de lijst lang en oninteressant is, stel dan een top-N-limiet in om deze terug te brengen tot de woorden die de moeite waard zijn om te lezen.
Wanneer u de gewenste weergave heeft, kopieert u de tabel. Het kopieert als rijen met tabs, wat betekent dat het netjes in een spreadsheetkolom of een documenttabel past zonder enige herformattering. Ik bewaar een klein spreadsheet met krukwoordtellingen over artikelen, zodat ik kan zien of ik in de loop van de tijd aan het verbeteren ben, en de op tabs gescheiden export valt er rechtstreeks in.
Wat zijn stopwoorden, en moet ik ze verwijderen?
Stopwoorden zijn de hoogfrequente functiewoorden die zinnen bij elkaar houden maar op zichzelf bijna geen actuele betekenis hebben: "the, " "a, " "and, " "of," "to, "is, " "in, " en hun vele metgezellen, In bijna elk Engels document domineren deze woorden de bovenkant van een ruwe frequentielijst Als je een artikel van duizend woorden telt zonder te filteren, zullen de eerste zes of zeven rijen stopwoorden zijn, en de woorden waar het artikel onder staat, zullen er daadwerkelijk over begraven worden.
Of je ze moet verwijderen hangt volledig af van je doel Zet het filter aan wanneer je probeert te zien waar een document over gaat, want door de grammatica te ontdoen blijven de inhoudswoorden staan Laat het staan wanneer je een exacte, ongefilterde telling van elk token nodig hebt, bijvoorbeeld wanneer je zinsstructuur bestudeert, de werkelijke lengte meet, of controleert hoe vaak je een specifieke connective zoals & quot;hoe dan ook" of & quot;meerover." controleert
Er is geen enkele officiële lijst van Engelse stopwoorden Verschillende tools en bibliotheken verzenden iets verschillende sets, en de keuze is eerder een beoordelingsoproep dan een standaard Deze tool maakt gebruik van een compacte, veelgebruikte lijst met veelgebruikte Engelse functiewoorden Als een woord dat u als betekenisvol beschouwt wordt gefilterd, is dat een teken dat uw onderwerp overlapt met de functiewoordset, en u moet het filter uitschakelen voor die specifieke telling.
Hoe wordt er omgegaan met weeën, koppeltekens en andere talen?
Woordsplitsing klinkt triviaal tot je goed kijkt, en dan wordt het een nest van randgevallen Wat telt als één woord?
Deze tool splitst op Unicode-letters en cijfers, en houdt een apostrof of koppelteken bij als het tussen twee letter- of cijferruns zit. Die enkele regel behandelt de gevallen die er het meest toe doen. De samentrekking & quot;don't" blijft één woord in plaats van te splitsen in "don" en "t." De samenstelling & quot;state-of-the-art" blijft intact in plaats van op elk koppelteken in vier fragmenten te verbrijzelen. Maar een verdwaald koppelteken dat als streepje wordt gebruikt, of een achterliggende apostrof die als aanhalingsteken wordt gebruikt, wordt niet op een ander woord geplakt.
Omdat de matching Unicode-bewust is, werken geaccentueerde en niet-Latijnse scripts ook. "Café" telt als één woord met zijn accent intact, en tekst in talen die niet-Latijnse letters gebruiken, wordt gesplitst op dezelfde letter-en-cijferregel in plaats van te worden geschrapt. Getallen worden behandeld als woorden, dus "2026" en "42" verschijnen in de tabel. Als u proza telt waar cijfers ruis zijn, kunt u ze met de optie met minimale lengte en een snelle scan negeren.
Wat is trefwoorddichtheid en hoe laat deze tool dit zien?
Trefwoorddichtheid is een woord' s aandeel van het totale aantal woorden, geschreven als percentage Als een pagina van 500 woorden uw doelzoekwoord 10 keer gebruikt, is de dichtheid 2 procent De frequentieteller toont dit in de procentuele kolom naast elke telling, zodat u nooit zelf de verdeling hoeft te doen.
Hier is de eerlijke versie van het SEO-advies: er is geen magic density-nummer dat een pagina rangschikt, en dat is er ook nooit geweest Zoekmachines zijn vele jaren geleden gestopt met het belonen van ruwe trefwoordherhaling, en Google' zijn eigen richtlijnen waarschuwen specifiek voor het vullen van trefwoorden, de praktijk van het proppen van een term op een pagina om ranglijsten te manipuleren. Voor welke dichtheid echt nuttig is, is de tegenovergestelde controle. Het bevestigt dat een pagina het onderwerp überhaupt vermeldt, en het markeert de pagina's waar je per ongeluk een zin zo vaak hebt herhaald dat een menselijke lezer het zou opmerken en een zoekmachine het als spam zou kunnen behandelen. Ik gebruik het als rookmelder, niet als doelwit.
In de onderstaande tabel staat hoe ik de verschillende signalen lees die een frequentietelling geeft, afhankelijk van wat ik probeer te leren.
| doelwit | Waarnaar te kijken | Dat instellen helpt | Hoe een slecht resultaat eruit ziet |
|---|---|---|---|
| Vang kruk woorden | Inhoudelijke woorden met verrassend hoge tellingen | Case vouwen op, stop woorden uit | Eén informeel woord komt 10+ keer voor in een kort stuk |
| Controleer de dichtheid van trefwoorden | Percentagekolom voor uw doelzin | Case vouwen op | Streef naar minder dan 0,5 procent, of een enkel woord meer dan 4 tot 5 procent |
| Een document samenvatten | Top 10 tot 15 rijen | Stop woorden op, min lengte 3 | Niets, hier is het filter voor |
| Bewerken voor afwisseling | Elk inhoudswoord met een hoge telling | Stop woorden aan | Hetzelfde bijvoeglijk naamwoord dat in elke paragraaf wordt herhaald |
| Meet de werkelijke lengte | Totaal aantal woorden | Alle filters uit | Een tel ver van je doel |
Woordfrequentieteller versus een gewone woordteller
Deze twee tools raken voortdurend in de war omdat hun namen elkaar overlappen, dus het is de moeite waard om het verschil duidelijk te vermelden. Een woordteller antwoordt & quot; Hoeveel?" Het retourneert totalen: woorden, karakters, zinnen, soms leestijd. Het is het juiste hulpmiddel als je een lengtedoel, een tweetlimiet of een essayminimum hebt. Een woordfrequentieteller antwoordt " Welke woorden, en hoe vaak?" Het retourneert een verdeling, en het is het juiste hulpmiddel als je meer om nadruk, herhaling of dichtheid geeft dan om lengte.
Ze paren goed. Meestal loop ik een tocht door de woordenteller om lengte te bevestigen, dan door de frequentieteller om te controleren of de lengte niet met dezelfde drie woorden wordt opgevuld Als je ook met lijsten werkt in plaats van met proza, dan is de lijnsorteerder zal lijnen ontdubbelen en bestellen, en de tekst diff checker zal u precies laten zien wat er tussen twee versies van een document is veranderd En als het doel van uw bewerking is om de woordkeuze te variëren, zal de case converter verwerkt het mechanische deel van het hervormen van koppen en identificatiegegevens zodra u heeft besloten wat u wilt wijzigen.
Is mijn tekst privé?
Ja De hele analyse gebeurt in je browser met behulp van JavaScript De tekst die je plakt wordt nooit naar een server verzonden, nooit gelogd en nooit opgeslagen Dit doet er meer toe dan het klinkt, want de documenten die het meest de moeite waard zijn om te analyseren zijn vaak degene die je het minst wilt uploaden: een ongepubliceerd manuscript, een client' het vertrouwelijke rapport, een interne memo, een concept onder embargo.
Je hoeft me niet op mijn woord te geloven Open je browser' s netwerktab en bekijk het terwijl je telt, en je zult zien dat er geen verzoek uitgaat Of maak de verbinding met internet volledig los en blijf werken, want zodra de pagina is geladen, heeft de tool helemaal geen verbinding meer nodig Deze browser-first benadering is hetzelfde principe achter alles wat ik bouw, en als het onderwerp je interesseert, heb ik er meer over geschreven in de gids voor gegevensprivacy met online tools. Voor een breder beeld van waar een frequentieteller in een schrijf- en bewerkingsworkflow past, is de Handleiding voor productiviteitstools voor dekt de tools die ik voor de meeste bereik.
Veelgestelde vragen
Wat is woordfrequentie?
Woordfrequentie is het aantal keren dat elk afzonderlijk woord in een stuk tekst verschijnt. Een woordfrequentieteller meldt het als een gerangschikte tabel, waarbij elk uniek woord wordt vermeld met zijn telling en vaak het percentage van het geheel, dus de meest gebruikte woorden verschijnen bovenaan.
Hoe tel ik hoe vaak een woord voorkomt?
Plak uw tekst in de tool en lees de gerangschikte tabel, die elk woord met de telling opsomt. Om je op één woord te concentreren, sorteer je alfabetisch of scan je de tabel ervoor. Elk voorval wordt geteld en het vouwen van de cases is standaard ingeschakeld, dus formulieren met hoofdletters en kleine letters tellen samen.
Wat zijn stopwoorden en moet ik ze verwijderen?
Stopwoorden zijn hoogfrequente functiewoorden zoals de, en, van, tot, en is dat met weinig actuele betekenis. Het verwijderen ervan is optioneel. Schakel het filter in wanneer u de rangschikking wilt laten verschijnen in de inhoudswoorden waar een document over gaat, laat het uit als u een exacte, ongefilterde telling van elk woord nodig heeft.
Behandelt de teller hoofdletters en kleine letters als hetzelfde woord?
Standaard ja. Case vouwen is aan, dus de, de, en de worden geteld als één woord. Schakel de hoofdlettergevoelige modus in wanneer hoofdletters van belang zijn, bijvoorbeeld om een eigennaamwoord los te tellen van dezelfde letters die als een gewoon woord worden gebruikt.
Hoe worden samentrekkingen en woordafbrekingen behandeld?
Woorden worden gesplitst op Unicode-letters en cijfers, maar er wordt een apostrof of koppelteken tussen twee letter- of cijferruns behouden. Dus don't telt als één woord in plaats van twee, en de modernste blijft één enkel token in plaats van dat het bij elk koppelteken wordt verbroken.
Wat is de dichtheid van het trefwoord en hoe laat deze tool het zien?
Sleutelwoorddichtheid is een woord' s aandeel van het totale aantal woorden, uitgedrukt als een percentage Het gereedschap toont het in de procentuele kolom naast elke telling, zodat u kunt controleren of een doelzin vaak genoeg verschijnt om relevant te zijn zonder te worden herhaald tot het punt van trefwoordvulling.
Is er een limiet aan hoeveel tekst ik kan analyseren?
Er is geen vaste limiet. Omdat de analyse in uw browser wordt uitgevoerd in plaats van op een server, bent u alleen gebonden aan uw apparaatgeheugen, dus volledige artikelen en boeklengte manuscripten worden afgehandeld zonder uploadlimiet.
Is mijn tekst ergens geüpload?
heel weinig . De tekst wordt geanalyseerd door JavaScript in uw browser en wordt nooit verzonden, gelogd of opgeslagen. U kunt dit bevestigen door naar het tabblad Netwerk te kijken terwijl u telt, of door de verbinding met internet te verbreken, blijft de tool offline werken.
Geschreven door Liton, bouwer van [Toolz.dev] (/. Ik maak browsergebaseerde ontwikkelaarstools en schrijf over het ambacht van het bouwen ervan.



