Naar de inhoud
Quaestio

Woorden tellen

Plak je tekst of typ hem, dan wordt alles opnieuw geteld terwijl je schrijft.

  • 0

    Woorden

  • 0

    Tekens

  • 0

    Tekens zonder spaties

  • 0

    Zinnen

  • 0

    Alinea’s

Geschatte leestijd: 0 min.

Meest voorkomende woorden

Schrijf iets, dan verschijnen hier de meest voorkomende woorden.

Insluiten

Deze tool op je eigen site insluiten

Kopieer de code en plak die waar de tool moet verschijnen, bijvoorbeeld in een blogbericht of op een schoolpagina. Het is gratis, het kader heeft geen advertenties en de tool rekent in de browser van de bezoeker.

Zo werkt het

Woorden worden geteld als reeksen tekens die door spaties worden gescheiden, net zoals tekstverwerkers doen. Een samenstelling met een koppelteken telt dus als één woord. Leestekens die los staan, zoals een gedachtestreepje, tellen niet mee.

Tekens worden geteld zoals de lezer ze ziet, niet als geheugeneenheden. Een emoji telt daarom als één teken, ook al neemt hij in het geheugen meer ruimte in, en dat geldt ook voor een vlag of een gezin dat uit meerdere tekens bestaat.

Zinnen worden geteld op afsluitende leestekens, dus punt, vraagteken en uitroepteken. Afkortingen zoals bijv. kunnen daarom een zin te veel opleveren. Het getal is een schatting, geen uitkomst op de komma.

Alinea’s worden door een lege regel gescheiden. Een enkele regelovergang breekt dus geen alinea af.

De leestijd gaat uit van 200 woorden per minuut, een gangbaar richtgetal voor lopende tekst op een scherm. Vakteksten worden langzamer gelezen.

Niets van wat je schrijft verlaat je browser.

Wat als woord telt

Een woord is alles tussen twee spaties wat niet alleen uit leestekens bestaat. Een gedachtestreepje met spaties eromheen telt daarom niet als woord, maar woord,woord;woord zonder spaties telt als één. De lijst met meest voorkomende woorden telt anders: daar wordt de tekst bij leestekens gesplitst, koppeltekens en apostrofs blijven bij het woord, en alles wordt in kleine letters omgezet. E-mail en zo’n blijven één woord, en KAT is hetzelfde woord als kat.

De Unicode-standaard voor tekstsegmentatie wijst erop dat woordgrenzen niet alleen door spaties en leestekens worden bepaald, en dat sommige talen helemaal geen spaties gebruiken. Voor zulke tekst geeft het aantal woorden een vertekend beeld.

Tekens en grafeemclusters

De tool deelt de tekst in grafeemclusters met de functie Intl.Segmenter van de browser. Grafeemcluster is de Unicode-naam voor wat een lezer als één teken ziet, en volgens de standaard is elke emojireeks uit de aanbevolen set één cluster. De gezinsemoji 👨‍👩‍👧 bestaat uit vijf codepunten, drie personen en twee onzichtbare verbindingstekens, maar telt als één teken, net als een é die als e met een combinerend accent is getypt. De tekst “Hoi 👋🏽 jij” geeft 9 tekens, 7 zonder spaties. Een oudere browser zonder Intl.Segmenter telt in plaats daarvan codepunten, en daar is de gezinsemoji vijf tekens.

Voorbeeld en leestijd

De tekst “Zij kocht o.a. peren. Toen ging ze naar huis!” geeft 9 woorden, 45 tekens, 37 tekens zonder spaties en 3 zinnen, omdat de punt na o.a. door een spatie wordt gevolgd. Het juiste aantal zinnen is twee.

De leestijd is het aantal woorden gedeeld door 200, naar boven afgerond, met een minimum van een minuut: 201 woorden worden 2 minuten en 1.000 woorden 5. Een meta-analyse van Brysbaert over 190 studies met 18.573 deelnemers kwam uit op een gemiddelde van 238 woorden per minuut voor volwassenen die stil Engelse non-fictie lezen en 260 voor fictie, en concludeert dat de leessnelheid in andere talen afhangt van hoeveel woorden een taal nodig heeft voor dezelfde boodschap.

Bronnen

Zo worden de tools gecontroleerd