字节与字符统计
词、行、UTF-8
即时统计 UTF-8 字节、字符、词、行和句子。免费在线字节计数器。
统计在浏览器中完成,输入内容不会上传。
字符
0
词
0
行
0
Bytes (UTF-8)
0
- 字符数(不含空格)0
- 句0
输入表单或 API 限制。空格、换行和表情符号都计入 UTF-8 字节。
输入
这个工具是什么?
统计字符、去空白字符、词、行、句子和 UTF-8 字节。输入时顶部 KPI 即时更新,不会上传数据。
不同限制统计不同维度:UI 常限字符、数据库常限字节、文案常限词数、API 关心编码后体积。非 ASCII 往往一个字形对应多个 UTF-8 字节。
常见用途
- 检查 meta、社交文案或表单的字符/字节上限
- 对比 UI 文案翻译长度
- 测量 API 或日志 payload 的 UTF-8 字节大小
如何使用
- 粘贴或输入文本。顶部 KPI(字符、词、行、UTF-8 字节)即时更新。
- 在芯片行查看去空格字符数与句子数。
- 用 Sample 对比 ASCII 与韩文/emoji 的字节差异。
- 复制统计摘要或 Clear 清空。
示例
| 输入 / 设置 | 输出 | 说明 |
|---|---|---|
Hello world. | chars 12 · no-spaces 11 · words 2 · lines 1 · sentences 1 · UTF-8 12 | 简单 ASCII。 |
안녕하세요 | chars 5 · words 1 · UTF-8 15 | 韩文音节多为 3 字节 UTF-8。 |
Hi 👋 | chars 5 · words 2 · UTF-8 7 | 👋 为 2 个 UTF-16 单元、4 个 UTF-8 字节(合计 7)。 |
One.\nTwo! | lines 2 · sentences 2 · words 2 | 换行与句末标点。 |
检查 UTF-8 字节上限
输入表单或 API 上限。上限为 10 字节时,안녕😀 占 10 字节,剩余 0;再加一个空格为 11,超出 1 字节。复制的摘要包括上限和剩余或超出量。
只统计原文,不含 JSON 引号、转义、HTTP 头或文件元数据。Textarea 将换行规范为 LF;以 CRLF 存储的服务器每次换行多一个字节。UTF-8 与 GBK 等编码不同。
实践中的常见误区
- UTF-8 字节 ≠ 字符数:韩文、CJK、emoji 会抬高字节;不要只用
length估存储配额。 - 词数按空白分割:无空格的中文通常计为 1 个词——不是分词器。
- 字符数是 JS 的 UTF-16 长度:部分 emoji 显示为 1 个字形却计为 2。
- 句子以
.!?启发式检测,缩写可能多计。
参考资料
最后审阅: 2026-10-11
常见问题
- 为什么 UTF-8 字节数和字符数不同?
- 字符数是 JavaScript 字符串长度(UTF-16 代码单元);字节数是 TextEncoder 的 UTF-8 大小。 非 ASCII(韩文、emoji、变音符号)通常占更多字节;部分 emoji 为 2 个 UTF-16 单元、4 个 UTF-8 字节。
- 词数如何计算?
- trim 后按空白(空格、制表符、换行)分割;连续空白算一次分隔。无空格的中文等常计为 1 个词。
- 句子数对所有语言都准吗?
- 以 `.` `!` `?` 结尾为启发式。缩写(如 `Dr.`)或其它标点体系可能偏差。
- 文本会上传吗?
- 不会。统计仅在浏览器本地完成。
- 这个限制适用于 GBK 吗?
- 不适用。这里计算 UTF-8 原文字节,与 GBK 不同。不含 JSON 引号、转义或 HTTP 头。服务器使用 CRLF 时字节数可能更多。