Текст
Вставьте или наберите текст — и сразу увидите, сколько в нём слов, символов, предложений, абзацев и строк, сколько он весит в байтах, сколько времени займёт чтение и сколько SMS он займёт. Эмодзи, диакритика и языки без пробелов, например китайский и японский, считаются правильно, а всё вычисляется в вашем браузере.
0Слова
0Символы
0Без пробелов
0Предложения
0Абзацы
0Строки
Время чтения
0 секунд
Чтение вслух
0 секунд
Средняя длина слова
0
Байты в UTF-8
0
Единицы UTF-16 (String.length)
0
Кодовые точки Unicode
0
SMS и лимиты символов
0SMS
Кодировка GSM-7: 0 единиц, до 160 на сообщение.
Пост в X (Twitter)0 / 280
Тег title (SEO)0 / 60
Meta description (SEO)0 / 160
Название на YouTube0 / 100
Подпись в Instagram0 / 2 200
Пост в LinkedIn0 / 3 000

Как это работает

Подсчёт символов кажется простым, пока не появится эмодзи. То, что видит человек, не совпадает ни с тем, что хранит база данных, ни с тем, что возвращает язык программирования: эмодзи «семья» — это один символ на экране, но 5 кодовых точек Unicode, 8 единиц UTF-16 (столько возвращает String.length в JavaScript, Java или C#) и 18 байт в UTF-8. Инструмент показывает все четыре величины, поэтому подходит и для маркетингового текста, и для расчёта размера столбца VARCHAR.

Слова, предложения и символы считаются по правилам сегментации Unicode, встроенным в браузер, — тем же, по которым он перемещает курсор или выделяет слово двойным щелчком. Поэтому инструмент работает и с языками, где слова не разделяются пробелами, например с китайским и японским, и не считает букву с комбинируемым диакритическим знаком за два символа.

Время чтения рассчитывается по средним скоростям из метаанализа 190 исследований (Brysbaert, 2019): 238 слов в минуту при чтении нехудожественного текста про себя и 183 при чтении вслух. Текст не покидает ваш браузер и не сохраняется в ссылке для обмена.

Примеры

👨‍👩‍👧1 · 5 · 8 · 18Один видимый символ, 5 кодовых точек (три эмодзи, соединённые двумя невидимыми символами-связками), 8 единиц UTF-16 и 18 байт в UTF-8. Если API ограничивает текст 280 «символами», стоит выяснить, какую из этих величин оно имеет в виду.
SMS · 151 GSM-7 → 151 UCS-21 SMS → 3 SMSSMS из 151 символа помещается в одно сообщение в алфавите GSM, но достаточно одной буквы í, чтобы телефон перешёл на UCS-2, где каждая часть вмещает 67 символов: тот же текст обойдётся уже в три сообщения.
café (NFC) · cafe + ◌́ (NFD)4 · 5Одно и то же слово может храниться с é как одной кодовой точкой или как e с последующим комбинируемым ударением. На экране они одинаковы, и этот инструмент в обоих случаях насчитает 4 символа, а String.length вернёт 4 или 5.

Сценарии использования

  • Подогнать заголовки и meta description под длину, которую Google показывает без обрезки.
  • Посчитать, во сколько SMS обойдётся рассылка или код подтверждения, и найти символ, который её удорожает.
  • Рассчитать размер столбца базы данных или проверить поле с лимитом в байтах, например VARCHAR в MySQL с utf8mb4.
  • Уложиться в минимальный или максимальный объём слов для работы, аннотации или конкурсной заявки.
  • Оценить, сколько займёт чтение статьи или озвучка сценария.
  • Найти слишком часто повторяющиеся слова перед публикацией текста.

Часто задаваемые вопросы

Почему другой счётчик показывает другое число?

Потому что единого способа считать нет. Многие счётчики используют String.length и считают единицы UTF-16, поэтому эмодзи идёт за 2 и больше; другие делят слова регулярными выражениями, которые режут по апострофам, и считают «don't» или «l'eau» за два слова. Здесь символы — это то, что видно на экране, а слова подчиняются правилам Unicode, что ближе всего к тому, как считает человек.

Почему одна буква с ударением меняет стоимость SMS?

7-битный алфавит GSM позволяет 160 символов в сообщении, но не содержит все буквы с диакритикой: в нём есть é, ñ, ü и à, но нет á, í, ó и ú. Одного символа вне этого алфавита достаточно, чтобы всё сообщение перешло на UCS-2, а лимит упал до 70 или до 67 на часть, если сообщение приходится делить. Некоторые операторы используют испанскую национальную таблицу, где они есть, но рассчитывать на это не стоит.

Сколько символов может быть в заголовке для Google?

Google обрезает не по числу символов, а по ширине в пикселях — около 600 на десктопе, поэтому реальный лимит зависит от букв: W занимает гораздо больше места, чем i. От 50 до 60 символов обычно помещается целиком; meta description показывается примерно до 155–160 символов. Полосы в инструменте используют эти значения как ориентир.

Совпадает ли подсчёт с X (Twitter)?

Почти всегда, но не полностью. X считает любую ссылку за 23 символа независимо от её длины, а китайские, японские и корейские символы — за 2. Для текстов без ссылок на латинице число совпадает.

Сколько байтов занимает текст в базе данных?

Зависит от кодировки столбца. В UTF-8 английские буквы занимают 1 байт, буквы с диакритикой и кириллица — 2, китайские иероглифы — 3, эмодзи — 4. MySQL с utf8mb4 считает длину VARCHAR в символах, а лимит строки — в байтах, а SQL Server с NVARCHAR использует UTF-16, что соответствует показателю «единицы UTF-16» в этом инструменте.