Tekst
Wklej lub wpisz tekst, a od razu zobaczysz, ile ma słów, znaków, zdań, akapitów i wierszy, ile zajmuje bajtów, ile trwa jego przeczytanie i ile SMS-ów zajmuje. Poprawnie liczy emoji, znaki diakrytyczne i języki bez spacji, takie jak chiński czy japoński, a wszystko jest obliczane w przeglądarce.
0Słowa
0Znaki
0Bez spacji
0Zdania
0Akapity
0Wiersze
Czas czytania
0 sekund
Czytane na głos
0 sekund
Średnia długość słowa
0
Bajty w UTF-8
0
Jednostki UTF-16 (String.length)
0
Punkty kodowe Unicode
0
SMS i limity znaków
0SMS
Kodowanie GSM-7: 0 jednostek, do 160 na wiadomość.
Post na X (Twitter)0 / 280
Znacznik title (SEO)0 / 60
Meta description (SEO)0 / 160
Tytuł w YouTube0 / 100
Opis na Instagramie0 / 2200
Post na LinkedIn0 / 3000

Jak to działa

Liczenie znaków wydaje się banalne, dopóki nie pojawi się emoji. To, co widzi człowiek, nie zgadza się ani z tym, co zapisuje baza danych, ani z tym, co zwraca język programowania: emoji rodziny to na ekranie jeden znak, ale 5 punktów kodowych Unicode, 8 jednostek UTF-16 (tyle zwraca String.length w JavaScripcie, Javie czy C#) i 18 bajtów w UTF-8. To narzędzie pokazuje wszystkie cztery miary, więc przyda się zarówno przy tekście marketingowym, jak i przy wymiarowaniu kolumny VARCHAR.

Słowa, zdania i znaki są liczone według reguł segmentacji Unicode wbudowanych w przeglądarkę — tych samych, których używa do przesuwania kursora czy zaznaczania dwuklikiem. Dlatego działa też z językami, które nie oddzielają słów spacjami, jak chiński czy japoński, i nie liczy litery ze znakiem łączącym jako dwóch znaków.

Czas czytania opiera się na średnich prędkościach z metaanalizy 190 badań (Brysbaert, 2019): 238 słów na minutę przy cichym czytaniu literatury faktu i 183 przy czytaniu na głos. Tekst nie opuszcza przeglądarki i nie jest zapisywany w linku do udostępnienia.

Przykłady

👨‍👩‍👧1 · 5 · 8 · 18Jeden widoczny znak, 5 punktów kodowych (trzy emoji połączone dwoma niewidocznymi znakami łączącymi), 8 jednostek UTF-16 i 18 bajtów w UTF-8. Jeśli API ogranicza do 280 „znaków”, warto sprawdzić, której z tych miar używa.
SMS · 151 GSM-7 → 151 UCS-21 SMS → 3 SMSSMS o długości 151 znaków mieści się w jednej wiadomości w alfabecie GSM, ale wystarczy jedno í, by telefon przeszedł na UCS-2, gdzie każda część mieści 67 znaków: ten sam tekst kosztuje wtedy trzy wiadomości.
café (NFC) · cafe + ◌́ (NFD)4 · 5To samo słowo można zapisać z é jako jednym punktem kodowym albo jako e z następującym po nim akcentem łączącym. Na ekranie wyglądają identycznie i to narzędzie liczy w obu przypadkach 4 znaki, ale String.length zwraca 4 lub 5.

Przypadki użycia

  • Dopasowanie tytułów i meta description do długości, którą Google wyświetla bez ucinania.
  • Obliczenie, ile SMS-ów będzie kosztować kampania lub kod weryfikacyjny, i znalezienie znaku, który ją podraża.
  • Wymiarowanie kolumny w bazie danych lub walidacja pola z limitem w bajtach, np. VARCHAR w MySQL z utf8mb4.
  • Zmieszczenie się w minimalnej lub maksymalnej liczbie słów pracy, streszczenia albo naboru.
  • Oszacowanie, ile trwa przeczytanie artykułu lub nagranie scenariusza.
  • Wyłapanie nadużywanych słów przed publikacją tekstu.

Najczęstsze pytania

Dlaczego inny licznik podaje inną liczbę?

Bo nie ma jednego sposobu liczenia. Wiele liczników używa String.length i liczy jednostki UTF-16, więc emoji to 2 lub więcej; inne dzielą słowa wyrażeniami regularnymi, które rozcinają na apostrofach, i liczą „don't” czy „l'eau” jako dwa słowa. Tutaj znaki to to, co widać na ekranie, a słowa podlegają regułom Unicode, co najbardziej przypomina liczenie przez człowieka.

Dlaczego jeden akcent zmienia koszt SMS-a?

7-bitowy alfabet GSM pozwala na 160 znaków w wiadomości, ale nie obejmuje wszystkich liter z akcentami: ma é, ñ, ü i à, lecz nie á, í, ó ani ú. Wystarczy jeden znak spoza tego alfabetu, by cała wiadomość przeszła na UCS-2, a limit spadł do 70 lub do 67 na część, jeśli trzeba ją podzielić. Niektórzy operatorzy używają hiszpańskiej tablicy narodowej, która je zawiera, ale nie warto na to liczyć.

Ile znaków może mieć tytuł dla Google?

Google nie ucina według liczby znaków, lecz według szerokości w pikselach, ok. 600 na komputerze, więc faktyczny limit zależy od liter: W zajmuje znacznie więcej niż i. Od 50 do 60 znaków zwykle mieści się w całości; meta description jest wyświetlana do ok. 155–160 znaków. Paski narzędzia używają tych wartości jako punktu odniesienia.

Czy liczenie zgadza się z X (Twitter)?

Prawie zawsze, ale nie do końca. X liczy każdy link jako 23 znaki niezależnie od jego długości, a znaki chińskie, japońskie i koreańskie jako 2. W tekstach bez linków w alfabecie łacińskim liczba jest taka sama.

Ile bajtów zajmuje tekst w bazie danych?

Zależy to od kodowania kolumny. W UTF-8 litery angielskie zajmują 1 bajt, litery z akcentami i cyrylica 2, chiński 3, a emoji 4. MySQL z utf8mb4 liczy długość VARCHAR w znakach, ale limit wiersza w bajtach, a SQL Server z NVARCHAR używa UTF-16, czyli miary „jednostki UTF-16” w tym narzędziu.