Texte
Collez ou saisissez un texte pour voir instantanément combien il compte de mots, de caractères, de phrases, de paragraphes et de lignes, combien d'octets il occupe, combien de temps il faut pour le lire et combien de SMS il utilise. Il compte correctement les emojis, les accents et les langues sans espaces comme le chinois ou le japonais, et tout est calculé dans votre navigateur.
0Mots
0Caractères
0Sans espaces
0Phrases
0Paragraphes
0Lignes
Temps de lecture
0 seconde
Lu à voix haute
0 seconde
Longueur moyenne des mots
0
Octets en UTF-8
0
Unités UTF-16 (String.length)
0
Points de code Unicode
0
SMS et limites de caractères
0SMS
Encodage GSM-7 : 0 unités, jusqu'à 160 par message.
Publication sur X (Twitter)0 / 280
Balise title (SEO)0 / 60
Meta description (SEO)0 / 160
Titre YouTube0 / 100
Légende Instagram0 / 2 200
Publication LinkedIn0 / 3 000

Comment ça marche

Compter les caractères semble trivial jusqu'à l'arrivée d'un emoji. Ce que voit une personne ne correspond ni à ce que stocke une base de données ni à ce que renvoie un langage de programmation : l'emoji famille est un seul caractère à l'écran, mais il représente 5 points de code Unicode, 8 unités UTF-16 (ce que renvoie String.length en JavaScript, Java ou C#) et 18 octets en UTF-8. Cet outil affiche les quatre mesures : il sert aussi bien pour un texte marketing que pour dimensionner une colonne VARCHAR.

Les mots, les phrases et les caractères sont comptés avec les règles de segmentation Unicode du navigateur, celles qu'il utilise pour déplacer le curseur ou sélectionner d'un double clic. C'est pourquoi l'outil fonctionne aussi avec les langues qui ne séparent pas les mots par des espaces, comme le chinois ou le japonais, et ne compte pas une lettre avec un accent combinant comme deux caractères.

Le temps de lecture repose sur les vitesses moyennes d'une méta-analyse de 190 études (Brysbaert, 2019) : 238 mots par minute en lecture silencieuse de non-fiction et 183 à voix haute. Le texte ne quitte pas votre navigateur et n'est pas enregistré dans le lien de partage.

Exemples

👨‍👩‍👧1 · 5 · 8 · 18Un caractère visible, 5 points de code (trois emojis reliés par deux caractères de jonction invisibles), 8 unités UTF-16 et 18 octets en UTF-8. Si une API limite à 280 « caractères », mieux vaut savoir laquelle de ces mesures elle utilise.
SMS · 151 GSM-7 → 151 UCS-21 SMS → 3 SMSUn SMS de 151 caractères tient en un seul message avec l'alphabet GSM, mais un seul í suffit pour que le téléphone passe en UCS-2, où chaque partie contient 67 caractères : le même texte coûte alors trois messages.
café (NFC) · cafe + ◌́ (NFD)4 · 5Le même mot peut être stocké avec le é comme un seul point de code ou comme un e suivi d'un accent combinant. À l'écran ils sont identiques et cet outil compte 4 caractères dans les deux cas, mais String.length renvoie 4 ou 5.

Cas d'usage

  • Ajuster les titres et les meta descriptions à la longueur affichée par Google pour qu'ils ne soient pas coupés.
  • Calculer combien de SMS coûtera une campagne ou un code de vérification, et repérer le caractère qui la renchérit.
  • Dimensionner une colonne de base de données ou valider un champ limité en octets, comme un VARCHAR dans MySQL en utf8mb4.
  • Respecter le nombre minimal ou maximal de mots d'un devoir, d'un résumé ou d'un appel à contributions.
  • Estimer la durée de lecture d'un article ou d'enregistrement d'un script.
  • Repérer les mots trop répétés avant de publier un texte.

Questions fréquentes

Pourquoi un autre compteur me donne-t-il un chiffre différent ?

Parce qu'il n'existe pas une seule façon de compter. Beaucoup de compteurs utilisent String.length et comptent des unités UTF-16, si bien qu'un emoji vaut 2 ou plus ; d'autres découpent les mots avec des expressions régulières qui coupent aux apostrophes et comptent « don't » ou « l'eau » comme deux mots. Ici, les caractères sont ce que l'on voit à l'écran et les mots suivent les règles Unicode, ce qui se rapproche le plus de la façon de compter d'une personne.

Pourquoi un accent change-t-il le coût d'un SMS ?

L'alphabet GSM 7 bits autorise 160 caractères par message mais n'inclut pas toutes les lettres accentuées : il a é, ñ, ü et à, mais pas á, í, ó ni ú. Avec un seul caractère hors de cet alphabet, tout le message passe en UCS-2 et la limite tombe à 70, ou à 67 par partie s'il faut le découper. Certains opérateurs utilisent la table nationale espagnole, qui les inclut, mais mieux vaut ne pas compter dessus.

Combien de caractères peut contenir un titre pour Google ?

Google ne coupe pas au nombre de caractères mais à la largeur en pixels, environ 600 sur ordinateur, donc la vraie limite dépend des lettres : un W prend bien plus de place qu'un i. Entre 50 et 60 caractères, le titre s'affiche en général en entier ; la meta description s'affiche jusqu'à environ 155 à 160 caractères. Les barres de l'outil utilisent ces valeurs comme référence.

Le décompte correspond-il à celui de X (Twitter) ?

Presque toujours, mais pas entièrement. X compte chaque lien comme 23 caractères, quelle que soit sa longueur, et les caractères chinois, japonais et coréens comme 2. Pour les textes sans liens en alphabet latin, le chiffre est identique.

Combien d'octets un texte occupe-t-il dans la base de données ?

Cela dépend de l'encodage de la colonne. En UTF-8, les lettres de l'anglais occupent 1 octet, les lettres accentuées et le cyrillique 2, le chinois 3 et les emojis 4. MySQL en utf8mb4 compte la longueur d'un VARCHAR en caractères mais la limite de ligne en octets, et SQL Server avec NVARCHAR utilise l'UTF-16, ce qui correspond à la mesure en unités UTF-16 de cet outil.