Tekst
Plak of typ een tekst en zie meteen hoeveel woorden, tekens, zinnen, alinea's en regels hij heeft, hoeveel bytes hij inneemt, hoe lang het lezen duurt en hoeveel sms'jes hij kost. Emoji's, accenten en talen zonder spaties, zoals Chinees of Japans, worden correct geteld, en alles wordt in je browser berekend.
0Woorden
0Tekens
0Zonder spaties
0Zinnen
0Alinea's
0Regels
Leestijd
0 seconden
Hardop voorgelezen
0 seconden
Gemiddelde woordlengte
0
Bytes in UTF-8
0
UTF-16-eenheden (String.length)
0
Unicode-codepunten
0
Sms en tekenlimieten
0sms
Codering GSM-7: 0 eenheden, tot 160 per bericht.
Bericht op X (Twitter)0 / 280
Title-tag (SEO)0 / 60
Metabeschrijving (SEO)0 / 160
YouTube-titel0 / 100
Instagram-bijschrift0 / 2.200
LinkedIn-bericht0 / 3.000

Hoe het werkt

Tekens tellen lijkt triviaal tot er een emoji opduikt. Wat een mens ziet, komt niet overeen met wat een database opslaat of wat een programmeertaal teruggeeft: de gezinsemoji is één teken op het scherm, maar bestaat uit 5 Unicode-codepunten, 8 UTF-16-eenheden (wat String.length in JavaScript, Java of C# teruggeeft) en 18 bytes in UTF-8. Deze tool toont alle vier de maten, dus hij is net zo bruikbaar voor een marketingtekst als voor het dimensioneren van een VARCHAR-kolom.

Woorden, zinnen en tekens worden geteld met de Unicode-segmentatieregels van de browser, dezelfde die hij gebruikt om de cursor te verplaatsen of met een dubbelklik te selecteren. Daarom werkt het ook voor talen die woorden niet met spaties scheiden, zoals Chinees of Japans, en telt een letter met een combinerend accent niet als twee tekens.

De leestijd gebruikt de gemiddelde snelheden uit een meta-analyse van 190 studies (Brysbaert, 2019): 238 woorden per minuut bij stil lezen van non-fictie en 183 bij hardop voorlezen. De tekst verlaat je browser niet en wordt niet in de deellink opgeslagen.

Voorbeelden

👨‍👩‍👧1 · 5 · 8 · 18Eén zichtbaar teken, 5 codepunten (drie emoji's verbonden door twee onzichtbare verbindingstekens), 8 UTF-16-eenheden en 18 bytes in UTF-8. Als een API tot 280 "tekens" beperkt, loont het om uit te zoeken welke van deze maten hij gebruikt.
SMS · 151 GSM-7 → 151 UCS-21 SMS → 3 SMSEen sms van 151 tekens past met het GSM-alfabet in één bericht, maar één í is genoeg om de telefoon naar UCS-2 te laten overschakelen, waar elk deel 67 tekens bevat: dezelfde tekst kost dan drie berichten.
café (NFC) · cafe + ◌́ (NFD)4 · 5Hetzelfde woord kan met é als één codepunt worden opgeslagen of als een e gevolgd door een combinerend accent. Op het scherm zijn ze identiek en deze tool telt in beide gevallen 4 tekens, maar String.length geeft 4 of 5.

Gebruiksscenario's

  • Titels en metabeschrijvingen afstemmen op de lengte die Google zonder afkappen toont.
  • Berekenen hoeveel sms'jes een campagne of verificatiecode kost en het teken vinden dat het duurder maakt.
  • Een databasekolom dimensioneren of een veld met een bytelimiet valideren, zoals VARCHAR in MySQL met utf8mb4.
  • Voldoen aan het minimum- of maximumaantal woorden van een opdracht, samenvatting of oproep.
  • Inschatten hoe lang het lezen van een artikel of het inspreken van een script duurt.
  • Te vaak herhaalde woorden opsporen voordat je een tekst publiceert.

Veelgestelde vragen

Waarom geeft een andere teller een ander getal?

Omdat er niet één manier van tellen is. Veel tellers gebruiken String.length en tellen UTF-16-eenheden, waardoor een emoji als 2 of meer telt; andere splitsen woorden met reguliere expressies die bij apostroffen knippen en tellen "don't" of "l'eau" als twee. Hier zijn tekens wat je op het scherm ziet en volgen woorden de Unicode-regels, wat het dichtst in de buurt komt van hoe een mens telt.

Waarom verandert een accent de kosten van een sms?

Het 7-bits GSM-alfabet staat 160 tekens per bericht toe, maar bevat niet alle letters met accent: é, ñ, ü en à wel, á, í, ó en ú niet. Met één teken buiten dat alfabet gaat het hele bericht over op UCS-2 en daalt de limiet naar 70, of naar 67 per deel als het gesplitst moet worden. Sommige providers gebruiken de Spaanse nationale tabel, die ze wel bevat, maar reken daar niet op.

Hoeveel tekens mag een titel voor Google hebben?

Google kapt niet af op tekens maar op breedte in pixels, zo'n 600 op desktop, dus de echte limiet hangt af van de letters: een W neemt veel meer ruimte in dan een i. Tussen 50 en 60 tekens past meestal volledig; de metabeschrijving wordt tot ongeveer 155 à 160 tekens getoond. De balken van de tool gebruiken die waarden als richtlijn.

Komt de telling overeen met die van X (Twitter)?

Bijna altijd, maar niet helemaal. X telt elke link als 23 tekens, ongeacht de lengte, en Chinese, Japanse en Koreaanse tekens als 2. Voor teksten zonder links in het Latijnse alfabet is het getal hetzelfde.

Hoeveel bytes neemt een tekst in de database in?

Dat hangt af van de codering van de kolom. In UTF-8 nemen Engelse letters 1 byte in, letters met accent en Cyrillisch 2, Chinees 3 en emoji's 4. MySQL met utf8mb4 telt de lengte van VARCHAR in tekens maar de rijlimiet in bytes, en SQL Server met NVARCHAR gebruikt UTF-16, wat overeenkomt met de maat UTF-16-eenheden van deze tool.