返回首页
中文 / emoji 与 \uXXXX 转义序列一键互转 · 本地处理
中文 ⇄ Unicode 转义
常用于 JS 国际化、接口调试、乱码修复;所有运算在本地浏览器完成

Unicode编码是什么?

Unicode(统一码、万国码)是为全球所有文字符号分配唯一编号的字符集,每个字符对应一个码点(Code Point),记作 U+XXXX。在 JavaScript、Java 等语言中,常用 \uXXXX 形式转义表示一个Unicode字符,例如「老」的码点是 U+8001,转义写法即 \u8001

当你遇到接口返回 \u4e2d\u6587 形式的乱码、或需要把中文嵌入只接受ASCII的配置文件时,用本工具即可一键还原或转义。

常见字符的Unicode编码示例

字符Unicode转义码点
\u4E2DU+4E2D
\u6587U+6587
你好\u4F60\u597DU+4F60 U+597D
😀\uD83D\uDE00U+1F600(代理对)
\uFFE5U+FFE5

典型使用场景

常见问题

为什么emoji转出来是两个\u?
emoji 码点超过 FFFF,在 UTF-16 中需用「代理对」表示,即两个 \uXXXX 组合(如 😀 = \uD83D\uDE00)。本工具按标准 UTF-16 规则处理,解码时也能正确还原。
\uXXXX 和 HTML实体 &#xXXXX; 一样吗?
不一样。\uXXXX 是 JavaScript/Java 的字符串转义;&#xXXXX; 是 HTML 字符实体。码点数值可能相同,但语法和用途不同,不能混用。
转换数据安全吗?
安全。所有转换均在浏览器本地通过 JavaScript 完成,不上传服务器、不留存记录。