Text
Füge einen Text ein oder tippe ihn, und du siehst sofort, wie viele Wörter, Zeichen, Sätze, Absätze und Zeilen er hat, wie viele Bytes er belegt, wie lange man zum Lesen braucht und wie viele SMS er füllt. Emojis, Akzente und Sprachen ohne Leerzeichen wie Chinesisch oder Japanisch werden korrekt gezählt, und alles wird in deinem Browser berechnet.
0Wörter
0Zeichen
0Ohne Leerzeichen
0Sätze
0Absätze
0Zeilen
Lesezeit
0 Sekunden
Vorgelesen
0 Sekunden
Durchschnittliche Wortlänge
0
Bytes in UTF-8
0
UTF-16-Einheiten (String.length)
0
Unicode-Codepunkte
0
SMS und Zeichenlimits
0SMS
Kodierung GSM-7: 0 Einheiten, bis zu 160 pro Nachricht.
Beitrag auf X (Twitter)0 / 280
Title-Tag (SEO)0 / 60
Meta-Description (SEO)0 / 160
YouTube-Titel0 / 100
Instagram-Bildunterschrift0 / 2.200
LinkedIn-Beitrag0 / 3.000

So funktioniert es

Zeichen zu zählen wirkt trivial, bis ein Emoji auftaucht. Was ein Mensch sieht, stimmt weder mit dem überein, was eine Datenbank speichert, noch mit dem, was eine Programmiersprache zurückgibt: Das Familien-Emoji ist auf dem Bildschirm ein einziges Zeichen, besteht aber aus 5 Unicode-Codepunkten, 8 UTF-16-Einheiten (das liefert String.length in JavaScript, Java oder C#) und 18 Bytes in UTF-8. Dieses Tool zeigt alle vier Werte und eignet sich daher für Marketingtexte ebenso wie für die Dimensionierung einer VARCHAR-Spalte.

Wörter, Sätze und Zeichen werden mit den Unicode-Segmentierungsregeln des Browsers gezählt – denselben, die er zum Bewegen des Cursors oder zum Markieren per Doppelklick nutzt. Deshalb funktioniert es auch bei Sprachen ohne Leerzeichen zwischen Wörtern wie Chinesisch oder Japanisch und zählt einen Buchstaben mit kombiniertem Akzent nicht als zwei Zeichen.

Die Lesezeit basiert auf den Durchschnittswerten einer Metaanalyse von 190 Studien (Brysbaert, 2019): 238 Wörter pro Minute beim stillen Lesen von Sachtexten und 183 beim lauten Vorlesen. Der Text verlässt deinen Browser nicht und wird nicht im Freigabelink gespeichert.

Beispiele

👨‍👩‍👧1 · 5 · 8 · 18Ein sichtbares Zeichen, 5 Codepunkte (drei Emojis, verbunden durch zwei unsichtbare Verbindungszeichen), 8 UTF-16-Einheiten und 18 Bytes in UTF-8. Begrenzt eine API auf 280 „Zeichen“, lohnt es sich herauszufinden, welche dieser Maße sie meint.
SMS · 151 GSM-7 → 151 UCS-21 SMS → 3 SMSEine SMS mit 151 Zeichen passt mit dem GSM-Alphabet in eine einzige Nachricht, doch ein einziges í genügt, damit das Telefon auf UCS-2 umschaltet, wo jeder Teil 67 Zeichen fasst: Derselbe Text kostet dann drei Nachrichten.
café (NFC) · cafe + ◌́ (NFD)4 · 5Dasselbe Wort kann mit é als einem einzigen Codepunkt oder als e gefolgt von einem kombinierenden Akzent gespeichert sein. Auf dem Bildschirm sehen beide gleich aus und dieses Tool zählt jeweils 4 Zeichen, String.length liefert aber 4 oder 5.

Anwendungsfälle

  • Titel und Meta-Descriptions auf die Länge bringen, die Google ohne Abschneiden anzeigt.
  • Berechnen, wie viele SMS eine Kampagne oder ein Bestätigungscode kostet, und das Zeichen finden, das sie verteuert.
  • Eine Datenbankspalte dimensionieren oder ein Feld mit Byte-Limit prüfen, etwa VARCHAR in MySQL mit utf8mb4.
  • Die Mindest- oder Höchstwortzahl einer Arbeit, eines Abstracts oder einer Ausschreibung einhalten.
  • Abschätzen, wie lange das Lesen eines Artikels oder das Einsprechen eines Skripts dauert.
  • Übermäßig wiederholte Wörter vor der Veröffentlichung eines Textes erkennen.

Häufige Fragen

Warum liefert ein anderer Zähler eine andere Zahl?

Weil es nicht die eine Zählweise gibt. Viele Zähler nutzen String.length und zählen UTF-16-Einheiten, sodass ein Emoji 2 oder mehr zählt; andere trennen Wörter mit regulären Ausdrücken, die an Apostrophen schneiden, und zählen „don't“ oder „l'eau“ als zwei. Hier sind Zeichen das, was du auf dem Bildschirm siehst, und Wörter folgen den Unicode-Regeln – das kommt der menschlichen Zählweise am nächsten.

Warum ändert ein Akzent den Preis einer SMS?

Das 7-Bit-GSM-Alphabet erlaubt 160 Zeichen pro Nachricht, enthält aber nicht alle Buchstaben mit Akzent: é, ñ, ü und à sind dabei, á, í, ó und ú nicht. Schon ein einziges Zeichen außerhalb dieses Alphabets schaltet die ganze Nachricht auf UCS-2, und das Limit sinkt auf 70 bzw. 67 pro Teil, wenn geteilt werden muss. Manche Netzbetreiber nutzen die spanische Nationaltabelle, die sie enthält, darauf sollte man sich aber nicht verlassen.

Wie viele Zeichen darf ein Titel für Google haben?

Google kürzt nicht nach Zeichen, sondern nach Breite in Pixeln, etwa 600 auf dem Desktop, das echte Limit hängt also von den Buchstaben ab: Ein W ist viel breiter als ein i. 50 bis 60 Zeichen passen meist vollständig; die Meta-Description wird bis etwa 155 bis 160 Zeichen angezeigt. Die Balken des Tools nutzen diese Werte als Richtwert.

Stimmt die Zählung mit der von X (Twitter) überein?

Fast immer, aber nicht ganz. X zählt jeden Link unabhängig von seiner Länge als 23 Zeichen und chinesische, japanische und koreanische Zeichen als 2. Bei Texten ohne Links im lateinischen Alphabet ist die Zahl gleich.

Wie viele Bytes belegt ein Text in der Datenbank?

Das hängt von der Kodierung der Spalte ab. In UTF-8 belegen englische Buchstaben 1 Byte, Buchstaben mit Akzent und Kyrillisch 2, Chinesisch 3 und Emojis 4. MySQL mit utf8mb4 zählt die VARCHAR-Länge in Zeichen, das Zeilenlimit aber in Bytes, und SQL Server mit NVARCHAR nutzt UTF-16 – das entspricht dem Wert „UTF-16-Einheiten“ dieses Tools.