中文 ⇄ Unicode 转义
常用于 JS 国际化、接口调试、乱码修复;所有运算在本地浏览器完成
Unicode编码是什么?
Unicode(统一码、万国码)是为全球所有文字符号分配唯一编号的字符集,每个字符对应一个码点(Code Point),记作 U+XXXX。在 JavaScript、Java 等语言中,常用 \uXXXX 形式转义表示一个Unicode字符,例如「老」的码点是 U+8001,转义写法即 \u8001。
当你遇到接口返回 \u4e2d\u6587 形式的乱码、或需要把中文嵌入只接受ASCII的配置文件时,用本工具即可一键还原或转义。
常见字符的Unicode编码示例
| 字符 | Unicode转义 | 码点 |
| 中 | \u4E2D | U+4E2D |
| 文 | \u6587 | U+6587 |
| 你好 | \u4F60\u597D | U+4F60 U+597D |
| 😀 | \uD83D\uDE00 | U+1F600(代理对) |
| ¥ | \uFFE5 | U+FFE5 |
典型使用场景
- 接口调试:后端返回 JSON 中文显示为 \uXXXX 时快速还原。
- 前端开发:JS 字符串中嵌入中文、特殊符号或 emoji。
- 配置文件:properties 等只接受 ISO-8859-1 的文件用 native2ascii 风格转义。
- 乱码排查:判断一段文本是否为 Unicode 转义未解析。
常见问题
为什么emoji转出来是两个\u?
emoji 码点超过 FFFF,在 UTF-16 中需用「代理对」表示,即两个 \uXXXX 组合(如 😀 = \uD83D\uDE00)。本工具按标准 UTF-16 规则处理,解码时也能正确还原。
\uXXXX 和 HTML实体 XXXX; 一样吗?
不一样。\uXXXX 是 JavaScript/Java 的字符串转义;&#xXXXX; 是 HTML 字符实体。码点数值可能相同,但语法和用途不同,不能混用。
转换数据安全吗?
安全。所有转换均在浏览器本地通过 JavaScript 完成,不上传服务器、不留存记录。