Compteur d'octets et de caractères
UTF-8
Comptez octets UTF-8, caractères, mots, lignes et phrases instantanément. Compteur d'octets en ligne gratuit.
Cette conversion s’exécute uniquement dans votre navigateur — rien n’est téléversé.
Counts run locally in your browser — nothing is uploaded.
Caractères
0
Mots
0
Lignes
0
Bytes (UTF-8)
0
- Characters (no spaces)0
- Phrases0
Entrée
Qu'est-ce que cet outil ?
Mesure caractères, caractères sans espaces, mots, lignes, phrases et octets UTF-8. Les KPI se mettent à jour en direct ; rien n’est téléversé.
Les limites ne comptent pas la même chose : UI en caractères, base en octets, brief en mots, API en taille encodée. Le non-ASCII prend souvent plusieurs octets UTF-8 par glyphe.
Cas d'usage courants
- Vérifier méta, posts ou champs face aux plafonds caractères vs octets
- Comparer la longueur des traductions d’UI
- Mesurer la taille UTF-8 des payloads API ou logs
Comment utiliser
- Collez ou saisissez du texte. Les KPI (caractères, mots, lignes, octets UTF-8) se mettent à jour en haut.
- Consultez caractères sans espaces et phrases dans la rangée de chips.
- Utilisez Sample pour comparer ASCII et Hangul/emoji.
- Copiez le résumé ou Clear.
Exemples
| Entrée / réglage | Sortie | Notes |
|---|---|---|
Hello world. | chars 12 · no-spaces 11 · words 2 · lines 1 · sentences 1 · UTF-8 12 | ASCII simple. |
안녕하세요 | chars 5 · words 1 · UTF-8 15 | Hangul : ~3 octets UTF-8 par syllabe. |
Hi 👋 | chars 5 · words 2 · UTF-8 7 | 👋 = 2 unités UTF-16, 4 octets UTF-8 (total 7). |
One.\nTwo! | lines 2 · sentences 2 · words 2 | Nouvelle ligne et ponctuation. |
Pièges courants
- Octets UTF-8 ≠ caractères : Hangul, CJK et emoji gonflent la taille ; ne vous fiez pas au seul
lengthpour les quotas. - Mots découpés sur espaces : un texte CJK sans espaces compte souvent comme un mot—pas de tokeniseur linguistique.
- Le compte de caractères est la longueur UTF-16 JS : certains emoji font deux « caractères ».
- Les phrases sont heuristiques (
.!?) ; les abréviations peuvent surcompter.
Références
Dernière révision: 2026-07-27
Questions fréquentes
- Pourquoi les octets UTF-8 diffèrent-ils des caractères ?
- Les caractères utilisent la longueur JavaScript (unités UTF-16). Les octets sont la taille UTF-8 de TextEncoder. Le texte non ASCII (Hangul, emoji, accents) prend souvent plusieurs octets ; certains emoji font deux unités UTF-16 et quatre octets UTF-8.
- Comment compte-t-on les mots ?
- Après trim, découpage sur les espaces. Des espaces consécutifs = une coupure. Un texte sans espaces (souvent CJK) compte comme un mot.
- Les phrases sont-elles exactes pour toutes les langues ?
- Heuristique sur `.`, `!`, `?`. Abréviations (`Dr.`) ou autre ponctuation peuvent fausser le total.
- Le texte est-il téléversé ?
- Non. Le comptage s’exécute uniquement dans le navigateur.