Unicode转中文
免费在线Unicode编码转换工具,\uXXXX转义与中文互转,支持混合文本解析,快速还原日志乱码,本地浏览器处理免登录即用,保障数据安全。
什么是Unicode转义
Unicode为世界上几乎所有文字系统的每个字符分配了唯一的编号(码点)。为了在ASCII有限的传输环境中表示这些字符,程序常采用「转义序列」的形式:以反斜杠加字母u开头,后跟4位十六进制码点,即\uXXXX。
例如「盘」的Unicode码点是U+76D8,转义后写作\u76d8;「子」写作\u5b50。常见场景包括:日志乱码(Java、Python的ascii场景、JSON等在输出非ASCII字符时可能统一转成\uXXXX)、配置文件与源码(properties文件默认不支持中文,需用\uXXXX表示)、接口报文(某些序列化框架如fastjson默认配置会把中文转义后传输)。
本工具支持混合文本解析——输入中同时包含普通字符和\uXXXX转义时,转义部分会被还原,其余字符保持不变;反向转换时,可打印的ASCII字符将保留原样,仅中文等非ASCII字符被转义,保证结果可读。
常见Unicode转义对照
| 字符 | 码点 | 转义形式 |
|---|---|---|
| 盘 | U+76D8 | \u76d8 |
| 子 | U+5B50 | \u5b50 |
| 工 | U+5DE5 | \u5de5 |
| 具 | U+5177 | \u5177 |
| 站 | U+7AD9 | \u7ad9 |
| 你 | U+4F60 | \u4f60 |
| 好 | U+597D | \u597d |
常见问题
日志里的中文变成了\uXXXX是乱码吗?
不是乱码,是Unicode转义。很多日志框架和序列化库(如Log4j、fastjson、Jackson默认配置)为保证ASCII兼容性,会把非ASCII字符转成\uXXXX形式输出。把内容粘贴到本工具即可一键还原为中文。
输入里同时有中文和\uXXXX转义能处理吗?
可以。Unicode→中文模式只替换文本中的\uXXXX转义序列,其余字符(包括已是中文的部分)原样保留,混合内容也能正确解析。
转换成Unicode后英文字母也会变成\uXXXX吗?
不会。中文→Unicode模式下,可打印的ASCII字符(字母、数字、常见英文符号)会保留原样,只有中文及其他非ASCII字符才会被转成\uXXXX,保证结果可读,也符合JSON等格式的常见输出习惯。
支持emoji和生僻字吗?
\uXXXX四位转义仅覆盖基本多文种平面(BMP)内的字符。大部分常用汉字都在该范围内,可以正常转换;但emoji等增补平面的字符码点超过U+FFFF,在JS中需要用代理对(两个连续的\u转义)表示,超出本工具的转换范围。