Unicode 转义序列

编解码

将文本转换为 Unicode 转义序列(\uXXXX)或反向解码。适用于代码和配置文件中的特殊字符处理。

此转换仅在您的浏览器中运行,不会上传任何内容。

\uXXXX 使用 UTF-16 码元(表情符号 → 代理对)。Hex 为 UTF-8 字节(\xXX)。HTML 为 &#x…; 数字实体。

  • 输入0
  • 输出0
  • 选项Unicode (\uXXXX)

输入

输出

这个工具是什么?

此 Unicode 转义编解码器在可读文本与转义写法之间转换。

  • Unicode (\uXXXX) — UTF-16 码元(JSON/JS 字符串风格)。表情等辅助平面字符使用代理对。
  • Hex (\xXX) — UTF-8 字节。
  • HTML (&#x…;) — 十六进制数字字符引用。

转义不是加密。输入即更新,仅在浏览器中处理。

常见用途

  • 阅读 API/应用日志中的 \uXXXX
  • 准备含 CJK 或表情的 JSON/JS 字符串转义
  • 对比同一字符的 UTF-16 转义与 UTF-8 \xXX 字节

如何使用

  1. 选择 Encode 或 Decode。输入或切换格式时结果立即更新。
  2. 按调试来源选择 Unicode / Hex / HTML。
  3. 粘贴文本或转义。Sample 加载 안녕 😀(或对应转义)。
  4. 复制输出。元信息显示字符数与 U+ 码位预览。

示例

输入 / 设置输出说明
Hi → Unicode 编码\u0048\u0069每个 BMP 字符一个 \uXXXX
Hi → Hex 编码\x48\x69ASCII 的 UTF-8 字节
\uD83D\uDE00 → Unicode 解码😀代理对 → U+1F600
A → HTML 解码A十六进制 HTML 实体

混合日志与无效输入

只转换所选格式,普通文本保持不变。Hex 将 status=\xec\x95\x88;ok 转为 status=안;ok。不完整的 \xec\x95 显示错误。Hex 使用 UTF-8,不支持 Latin-1。

Unicode 读取四位 UTF-16 单元:\uD83D\uDE00 为 😀,不支持 \u{1F600}。引号和 \n 保持原文,完整 JSON 请使用 JSON 解析器。

实践中的常见误区

  • 普通文本保留;所选格式的无效转义或无效 UTF-8 字节会显示错误,请选择匹配格式。
  • \uXXXX: UTF-16; \xXX: UTF-8; &#x…;: Unicode.

参考资料

最后审阅: 2026-10-11

常见问题

为什么表情符号会变成两个 \uXXXX?
\uXXXX 是 UTF-16 码元。BMP 以外的字符(许多表情)需要代理对,例如 😀 为 \uD83D\uDE00(U+1F600)。
Unicode、Hex、HTML 三种格式有何区别?
Unicode 输出 \uXXXX(UTF-16);Hex 按 UTF-8 字节输出 \xXX;HTML 输出 😀 这类十六进制数字实体。 请按日志或目标语言选择。
解码失败常见原因是什么?
所选格式的转义不完整或 UTF-8 字节无效会报错。其他格式与普通文本保持不变。
数据会上传到服务器吗?
不会。编解码仅在浏览器中运行。
不完整的 UTF-8 Hex 为什么报错?
Hex 将连续字节按 UTF-8 解码。\xec\x95 不完整,因此报错;它不是 Latin-1。普通文本与未选择的格式保持不变。