Unicode 转义与反转义

把文本转换为如 \u0041 的 Unicode 转义序列,或反转义还原为字符。

功能特性

\uXXXX 格式
\UXXXXXXXX 格式
&#xHHHH; 格式
&#DDDD; 格式

使用方法

1. 选择「转义」或「反转义」模式。

2. 把文本粘贴到输入框。

3. 结果显示在右侧 —— 点击「复制」即可。

关于这个工具

Unicode 转义让你只用 ASCII 就能写出任何字符,在字节必须精确的源代码、JSON、配置文件和 HTML 中很有用。这个工具可以在四种格式之间来回转换:JavaScript、JSON 和 Java 使用的 \uXXXX,其中 U+FFFF 以上的字符(如表情符号)会变成代理对;Python 和 C 使用的八位十六进制完整码点 \UXXXXXXXX;以及 HTML 数字引用 &#xHHHH; 和 &#DDDD;。只有非 ASCII 字符会被转义,普通字母和数字保持可读。反转义会识别所选格式,把序列还原成字符;如果在转义模式下粘贴了已转义的文本,工具会自动切换方向。

常见问题

\u 和 \U 转义有什么区别?
\u 后面跟四位十六进制数,表示一个 UTF-16 码元,所以 U+FFFF 以上的字符需要两个转义(代理对)。\U 后面跟八位十六进制数,直接表示完整码点,Python 和 C 支持这种写法。
为什么一个表情符号变成了两个 \u 转义?
😀(U+1F600)这类表情符号位于基本多文种平面之外。在 JavaScript 和 Java 使用的 UTF-16 中,它们以高位代理和低位代理两个码元存储,例如 \ud83d\ude00。
HTML 中什么时候该用 &#x; 或 &#;?
UTF-8 页面通常可以直接书写字符。数字引用适用于系统会删除非 ASCII 文本的场合、需要不换行空格这类不可见字符时,或编码受限的 XML 文件。
Unicode 转义和 URL 编码一样吗?
不一样。URL 编码把字符的 UTF-8 字节转换成 %XX 序列,é 变成 %C3%A9;Unicode 转义写的是码点,é 变成 \u00e9 或 é。
为什么有些转义字符串无法还原?
序列必须与所选格式完全匹配。孤立的代理项、缺少位数,或在同一段文本中混用 \u00e9 和 é 等格式,都会让这些部分保持不变。

相关工具