Unicode转中文

免费在线Unicode编码转换工具,\uXXXX转义与中文互转,支持混合文本解析,快速还原日志乱码,本地浏览器处理免登录即用,保障数据安全。

0 次使用 0
将 \uXXXX、\u{}、&#x; 等转义序列还原为中文
37 字符
12 字符

什么是Unicode转义

Unicode为世界上几乎所有文字系统的每个字符分配了唯一的编号(码点)。为了在ASCII有限的传输环境中表示这些字符,程序常采用「转义序列」的形式:以反斜杠加字母u开头,后跟4位十六进制码点,即\uXXXX。

例如「盘」的Unicode码点是U+76D8,转义后写作\u76d8;「子」写作\u5b50。常见场景包括:日志乱码(Java、Python的ascii场景、JSON等在输出非ASCII字符时可能统一转成\uXXXX)、配置文件与源码(properties文件默认不支持中文,需用\uXXXX表示)、接口报文(某些序列化框架如fastjson默认配置会把中文转义后传输)。

本工具支持混合文本解析——输入中同时包含普通字符和\uXXXX转义时,转义部分会被还原,其余字符保持不变;反向转换时,可打印的ASCII字符将保留原样,仅中文等非ASCII字符被转义,保证结果可读。

常见Unicode转义对照

字符码点转义形式
U+76D8\u76d8
U+5B50\u5b50
U+5DE5\u5de5
U+5177\u5177
U+7AD9\u7ad9
U+4F60\u4f60
U+597D\u597d

常见问题

日志里的中文变成了\uXXXX是乱码吗?

不是乱码,是Unicode转义。很多日志框架和序列化库(如Log4j、fastjson、Jackson默认配置)为保证ASCII兼容性,会把非ASCII字符转成\uXXXX形式输出。把内容粘贴到本工具即可一键还原为中文。

输入里同时有中文和\uXXXX转义能处理吗?

可以。Unicode→中文模式只替换文本中的\uXXXX转义序列,其余字符(包括已是中文的部分)原样保留,混合内容也能正确解析。

转换成Unicode后英文字母也会变成\uXXXX吗?

不会。中文→Unicode模式下,可打印的ASCII字符(字母、数字、常见英文符号)会保留原样,只有中文及其他非ASCII字符才会被转成\uXXXX,保证结果可读,也符合JSON等格式的常见输出习惯。

支持emoji和生僻字吗?

\uXXXX四位转义仅覆盖基本多文种平面(BMP)内的字符。大部分常用汉字都在该范围内,可以正常转换;但emoji等增补平面的字符码点超过U+FFFF,在JS中需要用代理对(两个连续的\u转义)表示,超出本工具的转换范围。