字节与字符统计
词、行、UTF-8
即时统计 UTF-8 字节、字符、词、行和句子。免费在线字节计数器。
此转换仅在您的浏览器中运行,不会上传任何内容。
Counts run locally in your browser — nothing is uploaded.
字符
0
词
0
行
0
Bytes (UTF-8)
0
- Characters (no spaces)0
- 句0
输入
这个工具是什么?
统计字符、去空白字符、词、行、句子和 UTF-8 字节。输入时顶部 KPI 即时更新,不会上传数据。
不同限制统计不同维度:UI 常限字符、数据库常限字节、文案常限词数、API 关心编码后体积。非 ASCII 往往一个字形对应多个 UTF-8 字节。
常见用途
- 检查 meta、社交文案或表单的字符/字节上限
- 对比 UI 文案翻译长度
- 测量 API 或日志 payload 的 UTF-8 字节大小
如何使用
- 粘贴或输入文本。顶部 KPI(字符、词、行、UTF-8 字节)即时更新。
- 在芯片行查看去空格字符数与句子数。
- 用 Sample 对比 ASCII 与韩文/emoji 的字节差异。
- 复制统计摘要或 Clear 清空。
示例
| 输入 / 设置 | 输出 | 说明 |
|---|---|---|
Hello world. | chars 12 · no-spaces 11 · words 2 · lines 1 · sentences 1 · UTF-8 12 | 简单 ASCII。 |
안녕하세요 | chars 5 · words 1 · UTF-8 15 | 韩文音节多为 3 字节 UTF-8。 |
Hi 👋 | chars 5 · words 2 · UTF-8 7 | 👋 为 2 个 UTF-16 单元、4 个 UTF-8 字节(合计 7)。 |
One.\nTwo! | lines 2 · sentences 2 · words 2 | 换行与句末标点。 |
实践中的常见误区
- UTF-8 字节 ≠ 字符数:韩文、CJK、emoji 会抬高字节;不要只用
length估存储配额。 - 词数按空白分割:无空格的中文通常计为 1 个词——不是分词器。
- 字符数是 JS 的 UTF-16 长度:部分 emoji 显示为 1 个字形却计为 2。
- 句子以
.!?启发式检测,缩写可能多计。
参考资料
最后审阅: 2026-07-27
常见问题
- 为什么 UTF-8 字节数和字符数不同?
- 字符数是 JavaScript 字符串长度(UTF-16 代码单元);字节数是 TextEncoder 的 UTF-8 大小。 非 ASCII(韩文、emoji、变音符号)通常占更多字节;部分 emoji 为 2 个 UTF-16 单元、4 个 UTF-8 字节。
- 词数如何计算?
- trim 后按空白(空格、制表符、换行)分割;连续空白算一次分隔。无空格的中文等常计为 1 个词。
- 句子数对所有语言都准吗?
- 以 `.` `!` `?` 结尾为启发式。缩写(如 `Dr.`)或其它标点体系可能偏差。
- 文本会上传吗?
- 不会。统计仅在浏览器本地完成。