Contador de bytes y caracteres
palabras, UTF-8
Cuenta bytes UTF-8, caracteres, palabras, líneas y oraciones al instante. Contador de bytes online gratis.
Esta conversión se ejecuta solo en tu navegador; no se sube nada.
Counts run locally in your browser — nothing is uploaded.
Caracteres
0
Palabras
0
Líneas
0
Bytes (UTF-8)
0
- Characters (no spaces)0
- Oraciones0
Entrada
¿Qué es esta herramienta?
Mide caracteres, caracteres sin espacios, palabras, líneas, oraciones y bytes UTF-8. Los KPI se actualizan al escribir; no se sube nada.
Distintos límites cuentan cosas distintas: UI por caracteres, BD por bytes, editorial por palabras, API por tamaño codificado. El texto no ASCII suele ocupar varios bytes UTF-8 por glifo.
Casos de uso comunes
- Comprobar meta, redes o campos frente a límites de caracteres vs bytes
- Comparar longitud de traducciones de UI
- Medir el tamaño UTF-8 de payloads de API o logs
Cómo usar
- Pega o escribe texto. Los KPI (caracteres, palabras, líneas, bytes UTF-8) se actualizan arriba.
- Revisa caracteres sin espacios y oraciones en la fila de chips.
- Usa Sample para ver ASCII frente a Hangul/emoji.
- Copia el resumen o Clear al terminar.
Ejemplos
| Entrada / configuración | Salida | Notas |
|---|---|---|
Hello world. | chars 12 · no-spaces 11 · words 2 · lines 1 · sentences 1 · UTF-8 12 | ASCII simple. |
안녕하세요 | chars 5 · words 1 · UTF-8 15 | Hangul: ~3 bytes UTF-8 por sílaba. |
Hi 👋 | chars 5 · words 2 · UTF-8 7 | 👋 = 2 unidades UTF-16, 4 bytes UTF-8 (total 7). |
One.\nTwo! | lines 2 · sentences 2 · words 2 | Nueva línea y puntuación. |
Errores prácticos
- Bytes UTF-8 ≠ caracteres: Hangul, CJK y emoji inflan el tamaño; no uses solo
lengthpara cuotas de almacenamiento. - Palabras por espacios: texto CJK sin espacios suele contar como una palabra—no es un tokenizador lingüístico.
- El conteo de caracteres es longitud UTF-16 de JS: algunos emoji son dos “caracteres”.
- Las oraciones son heurísticas con
.!?; abreviaturas pueden sobrercontar.
Referencias
Última revisión: 2026-07-27
Preguntas frecuentes
- ¿Por qué los bytes UTF-8 difieren de los caracteres?
- Los caracteres usan la longitud de cadena de JavaScript (unidades UTF-16). Los bytes son el tamaño UTF-8 de TextEncoder. Texto no ASCII (Hangul, emoji, acentos) suele ocupar más de un byte; algunos emoji usan dos unidades UTF-16 y cuatro bytes UTF-8.
- ¿Cómo se cuentan las palabras?
- Tras trim, se parten por espacios en blanco. Espacios seguidos cuentan como un corte. Texto sin espacios (p. ej. muchas frases CJK) cuenta como una palabra.
- ¿Las oraciones son exactas en todos los idiomas?
- Son heurísticas con `.`, `!` o `?`. Abreviaturas (`Dr.`) u otros sistemas de puntuación pueden desviar el conteo.
- ¿Se sube el texto?
- No. Todo el conteo ocurre en tu navegador.