字节与字符统计

词、行、UTF-8

即时统计 UTF-8 字节、字符、词、行和句子。免费在线字节计数器。

此转换仅在您的浏览器中运行,不会上传任何内容。

Counts run locally in your browser — nothing is uploaded.

字符

0

0

0

Bytes (UTF-8)

0

  • Characters (no spaces)0
  • 0

输入

这个工具是什么?

统计字符、去空白字符、、句子和 UTF-8 字节。输入时顶部 KPI 即时更新,不会上传数据。

不同限制统计不同维度:UI 常限字符、数据库常限字节、文案常限词数、API 关心编码后体积。非 ASCII 往往一个字形对应多个 UTF-8 字节。

常见用途

  • 检查 meta、社交文案或表单的字符/字节上限
  • 对比 UI 文案翻译长度
  • 测量 API 或日志 payload 的 UTF-8 字节大小

如何使用

  1. 粘贴或输入文本。顶部 KPI(字符、词、行、UTF-8 字节)即时更新。
  2. 在芯片行查看去空格字符数与句子数。
  3. 用 Sample 对比 ASCII 与韩文/emoji 的字节差异。
  4. 复制统计摘要或 Clear 清空。

示例

输入 / 设置输出说明
Hello world.chars 12 · no-spaces 11 · words 2 · lines 1 · sentences 1 · UTF-8 12简单 ASCII。
안녕하세요chars 5 · words 1 · UTF-8 15韩文音节多为 3 字节 UTF-8。
Hi 👋chars 5 · words 2 · UTF-8 7👋 为 2 个 UTF-16 单元、4 个 UTF-8 字节(合计 7)。
One.\nTwo!lines 2 · sentences 2 · words 2换行与句末标点。

实践中的常见误区

  • UTF-8 字节 ≠ 字符数:韩文、CJK、emoji 会抬高字节;不要只用 length 估存储配额。
  • 词数按空白分割:无空格的中文通常计为 1 个词——不是分词器。
  • 字符数是 JS 的 UTF-16 长度:部分 emoji 显示为 1 个字形却计为 2
  • 句子以 . ! ? 启发式检测,缩写可能多计。

参考资料

最后审阅: 2026-07-27

常见问题

为什么 UTF-8 字节数和字符数不同?
字符数是 JavaScript 字符串长度(UTF-16 代码单元);字节数是 TextEncoder 的 UTF-8 大小。 非 ASCII(韩文、emoji、变音符号)通常占更多字节;部分 emoji 为 2 个 UTF-16 单元、4 个 UTF-8 字节。
词数如何计算?
trim 后按空白(空格、制表符、换行)分割;连续空白算一次分隔。无空格的中文等常计为 1 个词。
句子数对所有语言都准吗?
以 `.` `!` `?` 结尾为启发式。缩写(如 `Dr.`)或其它标点体系可能偏差。
文本会上传吗?
不会。统计仅在浏览器本地完成。