Compteur d'octets et de caractères

UTF-8

Comptez octets UTF-8, caractères, mots, lignes et phrases instantanément. Compteur d'octets en ligne gratuit.

Cette conversion s’exécute uniquement dans votre navigateur — rien n’est téléversé.

Counts run locally in your browser — nothing is uploaded.

Caractères

0

Mots

0

Lignes

0

Bytes (UTF-8)

0

  • Characters (no spaces)0
  • Phrases0

Entrée

Qu'est-ce que cet outil ?

Mesure caractères, caractères sans espaces, mots, lignes, phrases et octets UTF-8. Les KPI se mettent à jour en direct ; rien n’est téléversé.

Les limites ne comptent pas la même chose : UI en caractères, base en octets, brief en mots, API en taille encodée. Le non-ASCII prend souvent plusieurs octets UTF-8 par glyphe.

Cas d'usage courants

  • Vérifier méta, posts ou champs face aux plafonds caractères vs octets
  • Comparer la longueur des traductions d’UI
  • Mesurer la taille UTF-8 des payloads API ou logs

Comment utiliser

  1. Collez ou saisissez du texte. Les KPI (caractères, mots, lignes, octets UTF-8) se mettent à jour en haut.
  2. Consultez caractères sans espaces et phrases dans la rangée de chips.
  3. Utilisez Sample pour comparer ASCII et Hangul/emoji.
  4. Copiez le résumé ou Clear.

Exemples

Entrée / réglageSortieNotes
Hello world.chars 12 · no-spaces 11 · words 2 · lines 1 · sentences 1 · UTF-8 12ASCII simple.
안녕하세요chars 5 · words 1 · UTF-8 15Hangul : ~3 octets UTF-8 par syllabe.
Hi 👋chars 5 · words 2 · UTF-8 7👋 = 2 unités UTF-16, 4 octets UTF-8 (total 7).
One.\nTwo!lines 2 · sentences 2 · words 2Nouvelle ligne et ponctuation.

Pièges courants

  • Octets UTF-8 ≠ caractères : Hangul, CJK et emoji gonflent la taille ; ne vous fiez pas au seul length pour les quotas.
  • Mots découpés sur espaces : un texte CJK sans espaces compte souvent comme un mot—pas de tokeniseur linguistique.
  • Le compte de caractères est la longueur UTF-16 JS : certains emoji font deux « caractères ».
  • Les phrases sont heuristiques (. ! ?) ; les abréviations peuvent surcompter.

Références

Dernière révision: 2026-07-27

Questions fréquentes

Pourquoi les octets UTF-8 diffèrent-ils des caractères ?
Les caractères utilisent la longueur JavaScript (unités UTF-16). Les octets sont la taille UTF-8 de TextEncoder. Le texte non ASCII (Hangul, emoji, accents) prend souvent plusieurs octets ; certains emoji font deux unités UTF-16 et quatre octets UTF-8.
Comment compte-t-on les mots ?
Après trim, découpage sur les espaces. Des espaces consécutifs = une coupure. Un texte sans espaces (souvent CJK) compte comme un mot.
Les phrases sont-elles exactes pour toutes les langues ?
Heuristique sur `.`, `!`, `?`. Abréviations (`Dr.`) ou autre ponctuation peuvent fausser le total.
Le texte est-il téléversé ?
Non. Le comptage s’exécute uniquement dans le navigateur.