Unicode 中文转换
中文与 Unicode 编码互相转换,支持 \uXXXX 转义格式。
About Unicode 中文转换
\u4e2d文 这类 Unicode 转义序列是在只支持 ASCII 的环境里表示中文字符的标准方式:JSON 配置文件、JavaScript 字符串、Java properties 文件、API 报文都会用到。当你需要排查字符串为什么显示成 \u4e2d文 而不是中文,或者需要把中文写进必须保持纯 ASCII 的 JSON 文件时,这款转换器可以双向即时转换。
「中文 → Unicode」方向把每个非 ASCII 字符转换成 \uXXXX 转义形式,ASCII 字符保持不变——这与 JSON.stringify 和大多数序列化框架处理中文的方式一致,也是 Java .properties 文件和多数本地化流程期望的格式。纯 ASCII 输出还能避开默认字符集不是 UTF-8 的系统带来的乱码问题。
「Unicode → 中文」方向把 \uXXXX 转义还原成可读字符。适用于阅读压缩后的 JavaScript、查看 API 返回的转义中文、调试把非 ASCII 全部转义的日志,或从配置导出中恢复可读文本。工具同时支持 4 位 BMP 形式和 \u{...} 花括号形式(用于超出基本多文种平面的字符,如 emoji)。
转换完全在浏览器本地完成,输入即出结果,一键复制。工具正确处理代理对(surrogate pairs),BMP 之外的字符(生僻汉字、emoji、符号)也能无损往返转换——这是很多手写转换器的常见坑。
Frequently Asked Questions
\uXXXX 是什么格式?
这是标准的 Unicode 转义序列:\u 后跟恰好 4 位十六进制数字,表示一个字符的码位。例如 中 的码位是 U+4E2D,写作 \u4e2d。JSON、JavaScript、Java 等语言都支持。
为什么文本里出现 代理对转义 这样的成对转义?
基本多文种平面之外的字符(如 emoji)在 \uXXXX 格式里用代理对表示。需要单个转义时请使用花括号 \u{...} 输出。
这和 URL 编码(百分号编码)是一回事吗?
不是。URL 编码用 %XX 字节形式用于 URL 传输,\uXXXX 转义表示源代码和数据格式中的 Unicode 码位。URL 编码请使用本站的 URL 编解码工具。
能转换整个 JSON 文件吗?
可以——把 JSON 内容当文本粘贴即可,字符串内部的转义会被转换,结构字符保持不变。转换是线性时间操作,大文件也没有压力。