Unicode 转义序列
编解码
将文本转换为 Unicode 转义序列(\uXXXX)或反向解码。适用于代码和配置文件中的特殊字符处理。
此转换仅在您的浏览器中运行,不会上传任何内容。
\uXXXX 使用 UTF-16 码元(表情符号 → 代理对)。Hex 为 UTF-8 字节(\xXX)。HTML 为 &#x…; 数字实体。
- 输入0
- 输出0
- 选项Unicode (\uXXXX)
输入
输出
这个工具是什么?
此 Unicode 转义编解码器在可读文本与转义写法之间转换。
- Unicode (
\uXXXX) — UTF-16 码元(JSON/JS 字符串风格)。表情等辅助平面字符使用代理对。 - Hex (
\xXX) — UTF-8 字节。 - HTML (
&#x…;) — 十六进制数字字符引用。
转义不是加密。输入即更新,仅在浏览器中处理。
常见用途
- 阅读 API/应用日志中的
\uXXXX - 准备含 CJK 或表情的 JSON/JS 字符串转义
- 对比同一字符的 UTF-16 转义与 UTF-8
\xXX字节
如何使用
- 选择 Encode 或 Decode。输入或切换格式时结果立即更新。
- 按调试来源选择 Unicode / Hex / HTML。
- 粘贴文本或转义。Sample 加载
안녕 😀(或对应转义)。 - 复制输出。元信息显示字符数与 U+ 码位预览。
示例
| 输入 / 设置 | 输出 | 说明 |
|---|---|---|
Hi → Unicode 编码 | \u0048\u0069 | 每个 BMP 字符一个 \uXXXX |
Hi → Hex 编码 | \x48\x69 | ASCII 的 UTF-8 字节 |
\uD83D\uDE00 → Unicode 解码 | 😀 | 代理对 → U+1F600 |
A → HTML 解码 | A | 十六进制 HTML 实体 |
混合日志与无效输入
只转换所选格式,普通文本保持不变。Hex 将 status=\xec\x95\x88;ok 转为 status=안;ok。不完整的 \xec\x95 显示错误。Hex 使用 UTF-8,不支持 Latin-1。
Unicode 读取四位 UTF-16 单元:\uD83D\uDE00 为 😀,不支持 \u{1F600}。引号和 \n 保持原文,完整 JSON 请使用 JSON 解析器。
实践中的常见误区
- 普通文本保留;所选格式的无效转义或无效 UTF-8 字节会显示错误,请选择匹配格式。
\uXXXX: UTF-16;\xXX: UTF-8;&#x…;: Unicode.
参考资料
最后审阅: 2026-10-11
常见问题
- 为什么表情符号会变成两个 \uXXXX?
- \uXXXX 是 UTF-16 码元。BMP 以外的字符(许多表情)需要代理对,例如 😀 为 \uD83D\uDE00(U+1F600)。
- Unicode、Hex、HTML 三种格式有何区别?
- Unicode 输出 \uXXXX(UTF-16);Hex 按 UTF-8 字节输出 \xXX;HTML 输出 😀 这类十六进制数字实体。 请按日志或目标语言选择。
- 解码失败常见原因是什么?
- 所选格式的转义不完整或 UTF-8 字节无效会报错。其他格式与普通文本保持不变。
- 数据会上传到服务器吗?
- 不会。编解码仅在浏览器中运行。
- 不完整的 UTF-8 Hex 为什么报错?
- Hex 将连续字节按 UTF-8 解码。\xec\x95 不完整,因此报错;它不是 Latin-1。普通文本与未选择的格式保持不变。