Unicode 转义

文本与 \uXXXX 转义互转,完整支持中文与 emoji 代理对,一键复制结果。

什么是 Unicode 转义?

Unicode 转义(\uXXXX)是 JavaScript、JSON、Python 等编程语言中表示 Unicode 字符的通用写法:反斜杠加字母 u,后跟 4 位十六进制数,例如中文「你」写作 \u4F60。这种写法让任意字符都能用纯 ASCII 文本表示,因此在代码生成、日志输出、网络协议传输和配置文件中有广泛应用。

普通汉字、字母和数字的码点都在 0xFFFF 以内,一个 \uXXXX 就能表示;但 emoji 等字符的码点超过 0xFFFF,必须用一对「代理项」组合表示:高位代理项范围 D800-DBFF,低位代理项范围 DC00-DFFF。本工具严格按照码点遍历文本,遇到代理对会自动合并处理,保证双向转换不丢字、不乱码。

使用步骤

  1. 在上方输入框中粘贴或输入需要转换的文本,支持中文、英文、emoji 混排;
  2. 点击「编码 → \uXXXX」将文本转换为转义序列,或点击「解码 ← 原文」将 \uXXXX 还原为原文;
  3. 需要把上一步结果继续处理时,可用「上下交换」把结果送回输入框;
  4. 点击结果区的「复制」按钮一键复制到剪贴板。

常见问题

\uXXXX 转义是什么?
它是 JavaScript 等语言中表示 Unicode 字符的写法,\u 后跟 4 位十六进制数。例如中文「你」写作 \u4F60,在网络传输、代码生成和日志输出中很常见。
为什么 emoji 会被转成两个 \u?
emoji 等字符的码点超过 0xFFFF,无法用单个 \uXXXX 表示,必须用一对代理项(高位 D800-DBFF + 低位 DC00-DFFF)组合表示,例如 😀 写作 \uD83D\uDE00,这是标准做法。
转义后的 \u4F60 如何还原成中文?
点击「解码 ← 原文」即可把 \uXXXX 序列还原为可读文本,连续的代理对会自动合并成对应的 emoji 字符。
这个工具会把文本上传到服务器吗?
不会。所有转换都在浏览器本地完成,文本不会离开你的设备,适合处理敏感的代码片段或密钥内容。