tomai
登入
免費 · 文字工具

Unicode轉換

文字與 \uXXXX 逸出序列互轉,附帶逐字元碼點檢視器

文字
Unicode逸出序列
字元檢視器
字元 碼點 UTF-8位元組

什麼是 Unicode 轉換工具?

螢幕上每個字元背後都有一個數字碼點——字母、表情符號、漢字各有各的碼點——UTF-8 再把碼點編碼成位元組。大多數時候你看不到這一層,但它會在轉義後的 JSON 字串、亂碼和編碼錯誤裡冒出來。這個工具把文字轉成 \uXXXX 轉義序列,也能轉回來,並且逐字元檢查碼點、十進位值和原始 UTF-8 位元組,輸入時即時更新。它面向開發者、譯者,以及任何對著亂碼字串發愁的人。

它能解碼和檢查什麼

  • 🔄 文字轉 \uXXXX 轉義序列,或轉義序列還原成文字
  • 🔍 逐字元檢查器:碼點 U+XXXX、十進位值和 UTF-8 位元組
  • 🔢 依碼點處理超出基本平面的字元,例如表情符號
  • ⚡ 輸入時結果即時更新

什麼時候會用到編碼層

  • 排查在郵件或資料庫裡顯示成亂碼的字串
  • 手寫 JSON 時為非 ASCII 文字寫轉義序列
  • 弄清為什麼表情符號或漢字弄壞了舊系統
  • 查看某個字元在檔案裡實際儲存的位元組

一切都在瀏覽器本機完成,不上傳任何文字。轉義只作用於非 ASCII 字元和控制字元,純 ASCII 的輸出保持可讀。

最後更新 · 2026-09-01

碼點、代理對與 UTF-8 寬度

  • U+1F600 是一個字元、兩個 UTF-16 單元(代理對)、四個 UTF-8 位元組——同一個 emoji 有三種長度。
  • \uXXXX 以 UTF-16 編碼;\u{...} 以完整碼點編碼——放錯語言會把 emoji 悄悄劈開。
  • 下方位元組檢視顯示儲存與網路層將看到的確切內容。

一個字元不等於一個位元組

轉義雙向自由轉換

純文字會變成帶大寫四位十六進位的 \uXXXX 序列,可列印的 ASCII 字元原樣保留;把轉義序列貼回去,又會重新變回字元。

🔒

逐字元編碼檢視器

字串中的每個碼點都會列出 U+XXXX 形式、十進位值和原始 UTF-8 位元組——emoji、漢字和控制字元都包括在內,最多顯示前 200 個。

🎯

專治亂碼解碼難題

當 JSON 酬載裡顯示的是 \u4f60\u597d 而不是文字時,貼進來就能讀出真實字串;把亂碼輸出轉成轉義序列,也能看清究竟是哪些位元組出了問題。

常見問題

碼點和UTF-16碼元有什麼區別?

大多數字元占1個16位元碼元,但基本多文種平面之外的字元(例如很多表情符號)需要2個——即「代理對」。檢視器是按碼點讀取的,所以這類字元會正確顯示為一行,而不是兩行。

為什麼會需要 \uXXXX 逸出序列?

這是在JSON字串、JavaScript字串字面值,以及許多不接受原始UTF-8文字的設定/屬性檔案格式中,表示非ASCII字元的標準方式。

我的文字會被上傳嗎?

不會——一切都用純JavaScript在你的瀏覽器裡執行,你輸入的內容永遠不會傳送到伺服器。

為什麼 emoji 在某些日誌裡顯示成兩個怪方塊?

日誌把代理對拆成了兩個獨立轉義(D83D DE00)。任何把它們分開處理的環節都會破壞它;合併起來,或把日誌改為 \u{1F600} 這樣的碼點轉義,表情即可復原。

相關工具

相關工具