Contador de bytes y caracteres
palabras, UTF-8
Cuenta bytes UTF-8, caracteres, palabras, líneas y oraciones al instante. Contador de bytes online gratis.
El recuento se realiza en tu navegador; el texto no se sube.
Caracteres
0
Palabras
0
Líneas
0
Bytes (UTF-8)
0
- Caracteres sin espacios0
- Oraciones0
Indica el límite del formulario o API. Espacios, saltos de línea y emojis cuentan en UTF-8.
Entrada
¿Qué es esta herramienta?
Mide caracteres, caracteres sin espacios, palabras, líneas, oraciones y bytes UTF-8. Los KPI se actualizan al escribir; no se sube nada.
Distintos límites cuentan cosas distintas: UI por caracteres, BD por bytes, editorial por palabras, API por tamaño codificado. El texto no ASCII suele ocupar varios bytes UTF-8 por glifo.
Casos de uso comunes
- Comprobar meta, redes o campos frente a límites de caracteres vs bytes
- Comparar longitud de traducciones de UI
- Medir el tamaño UTF-8 de payloads de API o logs
Cómo usar
- Pega o escribe texto. Los KPI (caracteres, palabras, líneas, bytes UTF-8) se actualizan arriba.
- Revisa caracteres sin espacios y oraciones en la fila de chips.
- Usa Sample para ver ASCII frente a Hangul/emoji.
- Copia el resumen o Clear al terminar.
Ejemplos
| Entrada / configuración | Salida | Notas |
|---|---|---|
Hello world. | chars 12 · no-spaces 11 · words 2 · lines 1 · sentences 1 · UTF-8 12 | ASCII simple. |
안녕하세요 | chars 5 · words 1 · UTF-8 15 | Hangul: ~3 bytes UTF-8 por sílaba. |
Hi 👋 | chars 5 · words 2 · UTF-8 7 | 👋 = 2 unidades UTF-16, 4 bytes UTF-8 (total 7). |
One.\nTwo! | lines 2 · sentences 2 · words 2 | Nueva línea y puntuación. |
Comprueba un límite UTF-8
Indica el límite del formulario o API. Con 10 bytes, 안녕😀 ocupa 10 y deja 0; un espacio adicional ocupa 11 y excede el límite en 1. El resumen copiado incluye el límite y bytes restantes o excedidos.
Solo se mide texto, sin comillas JSON, escapes, cabeceras HTTP ni metadatos. El textarea normaliza saltos a LF; un servidor que almacena CRLF añade un byte por salto. UTF-8 no equivale a otras codificaciones.
Errores prácticos
- Bytes UTF-8 ≠ caracteres: Hangul, CJK y emoji inflan el tamaño; no uses solo
lengthpara cuotas de almacenamiento. - Palabras por espacios: texto CJK sin espacios suele contar como una palabra—no es un tokenizador lingüístico.
- El conteo de caracteres es longitud UTF-16 de JS: algunos emoji son dos “caracteres”.
- Las oraciones son heurísticas con
.!?; abreviaturas pueden sobrercontar.
Referencias
Última revisión: 2026-10-11
Preguntas frecuentes
- ¿Por qué los bytes UTF-8 difieren de los caracteres?
- Los caracteres usan la longitud de cadena de JavaScript (unidades UTF-16). Los bytes son el tamaño UTF-8 de TextEncoder. Texto no ASCII (Hangul, emoji, acentos) suele ocupar más de un byte; algunos emoji usan dos unidades UTF-16 y cuatro bytes UTF-8.
- ¿Cómo se cuentan las palabras?
- Tras trim, se parten por espacios en blanco. Espacios seguidos cuentan como un corte. Texto sin espacios (p. ej. muchas frases CJK) cuenta como una palabra.
- ¿Las oraciones son exactas en todos los idiomas?
- Son heurísticas con `.`, `!` o `?`. Abreviaturas (`Dr.`) u otros sistemas de puntuación pueden desviar el conteo.
- ¿Se sube el texto?
- No. Todo el conteo ocurre en tu navegador.
- ¿El límite incluye el tamaño de una petición JSON?
- No. Solo compara el texto UTF-8 con tu límite. No incluye comillas, escapes JSON ni cabeceras HTTP. Los saltos usan LF; un servidor con CRLF puede almacenar más bytes.