tomai
登录
免费 · 文本工具

Unicode转换

文本与 \uXXXX 转义序列互转,附带逐字符码点查看器

文本
Unicode转义
字符查看器
字符 码点 UTF-8字节

什么是 Unicode 转换工具?

屏幕上每个字符背后都有一个数字码点——字母、表情符号、汉字各有各的码点——UTF-8 再把码点编码成字节。大多数时候你看不到这一层,但它会在转义后的 JSON 字符串、乱码和编码 bug 里冒出来。这个工具把文本转成 \uXXXX 转义序列,也能转回来,并且逐个字符检查码点、十进制值和原始 UTF-8 字节,输入时实时更新。它面向开发者、译者,以及任何对着乱码字符串发愁的人。

它能解码和检查什么

  • 🔄 文本转 \uXXXX 转义序列,或转义序列还原成文本
  • 🔍 逐字符检查器:码点 U+XXXX、十进制值和 UTF-8 字节
  • 🔢 按码点处理超出基本平面的字符,比如 emoji
  • ⚡ 输入时结果实时更新

什么时候会用到编码层

  • 排查在邮件或数据库里显示成乱码的字符串
  • 手写 JSON 时为非 ASCII 文本写转义序列
  • 弄清为什么 emoji 或汉字弄坏了旧系统
  • 查看某个字符在文件里实际存储的字节

一切都在浏览器本地完成,不上传任何文本。转义只作用于非 ASCII 字符和控制字符,纯 ASCII 的输出保持可读。

最后更新 · 2026-09-01

码点、代理对与 UTF-8 宽度

  • U+1F600 是一个字符、两个 UTF-16 单元(代理对)、四个 UTF-8 字节——同一个 emoji 有三种长度。
  • \uXXXX 按 UTF-16 编码;\u{...} 按完整码点编码——放错语言会把 emoji 悄悄劈开。
  • 下方字节视图显示存储与网络层将看到的确切内容。

一个字符不等于一个字节

转义双向自由转换

纯文本会变成带大写四位十六进制的 \uXXXX 序列,可打印的 ASCII 字符原样保留;把转义序列粘贴回去,又会重新变回字符。

🔒

逐字符编码检视器

字符串中的每个码点都会列出 U+XXXX 形式、十进制值和原始 UTF-8 字节——emoji、汉字和控制字符都包括在内,最多显示前 200 个。

🎯

专治乱码解码难题

当 JSON 载荷里显示的是 \u4f60\u597d 而不是文字时,粘贴进来就能读出真实字符串;把乱码输出转成转义序列,也能看清究竟是哪些字节出了问题。

常见问题

码点和UTF-16码元有什么区别?

大多数字符占1个16位码元,但基本多文种平面之外的字符(比如很多表情符号)需要2个——即"代理对"。查看器是按码点读取的,所以这类字符会正确显示为一行,而不是两行。

为什么会需要 \uXXXX 转义?

这是在JSON字符串、JavaScript字符串字面量,以及许多不接受原始UTF-8文本的配置/属性文件格式中,表示非ASCII字符的标准方式。

我的文本会被上传吗?

不会——一切都用纯JavaScript在你的浏览器里运行,你输入的内容永远不会发送到服务器。

为什么 emoji 在某些日志里显示成两个怪方块?

日志把代理对拆成了两个独立转义(D83D DE00)。任何把它们分开处理的环节都会破坏它;合并起来,或把日志改为 \u{1F600} 这样的码点转义,表情即可复原。

相关工具

相关工具