Contador de bytes y caracteres

palabras, UTF-8

Cuenta bytes UTF-8, caracteres, palabras, líneas y oraciones al instante. Contador de bytes online gratis.

El recuento se realiza en tu navegador; el texto no se sube.

Caracteres

0

Palabras

0

Líneas

0

Bytes (UTF-8)

0

  • Caracteres sin espacios0
  • Oraciones0

Indica el límite del formulario o API. Espacios, saltos de línea y emojis cuentan en UTF-8.

Entrada

¿Qué es esta herramienta?

Mide caracteres, caracteres sin espacios, palabras, líneas, oraciones y bytes UTF-8. Los KPI se actualizan al escribir; no se sube nada.

Distintos límites cuentan cosas distintas: UI por caracteres, BD por bytes, editorial por palabras, API por tamaño codificado. El texto no ASCII suele ocupar varios bytes UTF-8 por glifo.

Casos de uso comunes

  • Comprobar meta, redes o campos frente a límites de caracteres vs bytes
  • Comparar longitud de traducciones de UI
  • Medir el tamaño UTF-8 de payloads de API o logs

Cómo usar

  1. Pega o escribe texto. Los KPI (caracteres, palabras, líneas, bytes UTF-8) se actualizan arriba.
  2. Revisa caracteres sin espacios y oraciones en la fila de chips.
  3. Usa Sample para ver ASCII frente a Hangul/emoji.
  4. Copia el resumen o Clear al terminar.

Ejemplos

Entrada / configuraciónSalidaNotas
Hello world.chars 12 · no-spaces 11 · words 2 · lines 1 · sentences 1 · UTF-8 12ASCII simple.
안녕하세요chars 5 · words 1 · UTF-8 15Hangul: ~3 bytes UTF-8 por sílaba.
Hi 👋chars 5 · words 2 · UTF-8 7👋 = 2 unidades UTF-16, 4 bytes UTF-8 (total 7).
One.\nTwo!lines 2 · sentences 2 · words 2Nueva línea y puntuación.

Comprueba un límite UTF-8

Indica el límite del formulario o API. Con 10 bytes, 안녕😀 ocupa 10 y deja 0; un espacio adicional ocupa 11 y excede el límite en 1. El resumen copiado incluye el límite y bytes restantes o excedidos.

Solo se mide texto, sin comillas JSON, escapes, cabeceras HTTP ni metadatos. El textarea normaliza saltos a LF; un servidor que almacena CRLF añade un byte por salto. UTF-8 no equivale a otras codificaciones.

Errores prácticos

  • Bytes UTF-8 ≠ caracteres: Hangul, CJK y emoji inflan el tamaño; no uses solo length para cuotas de almacenamiento.
  • Palabras por espacios: texto CJK sin espacios suele contar como una palabra—no es un tokenizador lingüístico.
  • El conteo de caracteres es longitud UTF-16 de JS: algunos emoji son dos “caracteres”.
  • Las oraciones son heurísticas con . ! ?; abreviaturas pueden sobrercontar.

Referencias

Última revisión: 2026-10-11

Preguntas frecuentes

¿Por qué los bytes UTF-8 difieren de los caracteres?
Los caracteres usan la longitud de cadena de JavaScript (unidades UTF-16). Los bytes son el tamaño UTF-8 de TextEncoder. Texto no ASCII (Hangul, emoji, acentos) suele ocupar más de un byte; algunos emoji usan dos unidades UTF-16 y cuatro bytes UTF-8.
¿Cómo se cuentan las palabras?
Tras trim, se parten por espacios en blanco. Espacios seguidos cuentan como un corte. Texto sin espacios (p. ej. muchas frases CJK) cuenta como una palabra.
¿Las oraciones son exactas en todos los idiomas?
Son heurísticas con `.`, `!` o `?`. Abreviaturas (`Dr.`) u otros sistemas de puntuación pueden desviar el conteo.
¿Se sube el texto?
No. Todo el conteo ocurre en tu navegador.
¿El límite incluye el tamaño de una petición JSON?
No. Solo compara el texto UTF-8 con tu límite. No incluye comillas, escapes JSON ni cabeceras HTTP. Los saltos usan LF; un servidor con CRLF puede almacenar más bytes.