Contador de bytes y caracteres

palabras, UTF-8

Cuenta bytes UTF-8, caracteres, palabras, líneas y oraciones al instante. Contador de bytes online gratis.

Esta conversión se ejecuta solo en tu navegador; no se sube nada.

Counts run locally in your browser — nothing is uploaded.

Caracteres

0

Palabras

0

Líneas

0

Bytes (UTF-8)

0

  • Characters (no spaces)0
  • Oraciones0

Entrada

¿Qué es esta herramienta?

Mide caracteres, caracteres sin espacios, palabras, líneas, oraciones y bytes UTF-8. Los KPI se actualizan al escribir; no se sube nada.

Distintos límites cuentan cosas distintas: UI por caracteres, BD por bytes, editorial por palabras, API por tamaño codificado. El texto no ASCII suele ocupar varios bytes UTF-8 por glifo.

Casos de uso comunes

  • Comprobar meta, redes o campos frente a límites de caracteres vs bytes
  • Comparar longitud de traducciones de UI
  • Medir el tamaño UTF-8 de payloads de API o logs

Cómo usar

  1. Pega o escribe texto. Los KPI (caracteres, palabras, líneas, bytes UTF-8) se actualizan arriba.
  2. Revisa caracteres sin espacios y oraciones en la fila de chips.
  3. Usa Sample para ver ASCII frente a Hangul/emoji.
  4. Copia el resumen o Clear al terminar.

Ejemplos

Entrada / configuraciónSalidaNotas
Hello world.chars 12 · no-spaces 11 · words 2 · lines 1 · sentences 1 · UTF-8 12ASCII simple.
안녕하세요chars 5 · words 1 · UTF-8 15Hangul: ~3 bytes UTF-8 por sílaba.
Hi 👋chars 5 · words 2 · UTF-8 7👋 = 2 unidades UTF-16, 4 bytes UTF-8 (total 7).
One.\nTwo!lines 2 · sentences 2 · words 2Nueva línea y puntuación.

Errores prácticos

  • Bytes UTF-8 ≠ caracteres: Hangul, CJK y emoji inflan el tamaño; no uses solo length para cuotas de almacenamiento.
  • Palabras por espacios: texto CJK sin espacios suele contar como una palabra—no es un tokenizador lingüístico.
  • El conteo de caracteres es longitud UTF-16 de JS: algunos emoji son dos “caracteres”.
  • Las oraciones son heurísticas con . ! ?; abreviaturas pueden sobrercontar.

Referencias

Última revisión: 2026-07-27

Preguntas frecuentes

¿Por qué los bytes UTF-8 difieren de los caracteres?
Los caracteres usan la longitud de cadena de JavaScript (unidades UTF-16). Los bytes son el tamaño UTF-8 de TextEncoder. Texto no ASCII (Hangul, emoji, acentos) suele ocupar más de un byte; algunos emoji usan dos unidades UTF-16 y cuatro bytes UTF-8.
¿Cómo se cuentan las palabras?
Tras trim, se parten por espacios en blanco. Espacios seguidos cuentan como un corte. Texto sin espacios (p. ej. muchas frases CJK) cuenta como una palabra.
¿Las oraciones son exactas en todos los idiomas?
Son heurísticas con `.`, `!` o `?`. Abreviaturas (`Dr.`) u otros sistemas de puntuación pueden desviar el conteo.
¿Se sube el texto?
No. Todo el conteo ocurre en tu navegador.