Unicode轉換
文字與 \uXXXX 逸出序列互轉,附帶逐字元碼點檢視器
| 字元 | 碼點 | UTF-8位元組 |
|---|
什麼是 Unicode 轉換工具?
螢幕上每個字元背後都有一個數字碼點——字母、表情符號、漢字各有各的碼點——UTF-8 再把碼點編碼成位元組。大多數時候你看不到這一層,但它會在轉義後的 JSON 字串、亂碼和編碼錯誤裡冒出來。這個工具把文字轉成 \uXXXX 轉義序列,也能轉回來,並且逐字元檢查碼點、十進位值和原始 UTF-8 位元組,輸入時即時更新。它面向開發者、譯者,以及任何對著亂碼字串發愁的人。
它能解碼和檢查什麼
- 🔄 文字轉 \uXXXX 轉義序列,或轉義序列還原成文字
- 🔍 逐字元檢查器:碼點 U+XXXX、十進位值和 UTF-8 位元組
- 🔢 依碼點處理超出基本平面的字元,例如表情符號
- ⚡ 輸入時結果即時更新
什麼時候會用到編碼層
- 排查在郵件或資料庫裡顯示成亂碼的字串
- 手寫 JSON 時為非 ASCII 文字寫轉義序列
- 弄清為什麼表情符號或漢字弄壞了舊系統
- 查看某個字元在檔案裡實際儲存的位元組
一切都在瀏覽器本機完成,不上傳任何文字。轉義只作用於非 ASCII 字元和控制字元,純 ASCII 的輸出保持可讀。
最後更新 · 2026-09-01
碼點、代理對與 UTF-8 寬度
- U+1F600 是一個字元、兩個 UTF-16 單元(代理對)、四個 UTF-8 位元組——同一個 emoji 有三種長度。
- \uXXXX 以 UTF-16 編碼;\u{...} 以完整碼點編碼——放錯語言會把 emoji 悄悄劈開。
- 下方位元組檢視顯示儲存與網路層將看到的確切內容。
一個字元不等於一個位元組
轉義雙向自由轉換
純文字會變成帶大寫四位十六進位的 \uXXXX 序列,可列印的 ASCII 字元原樣保留;把轉義序列貼回去,又會重新變回字元。
逐字元編碼檢視器
字串中的每個碼點都會列出 U+XXXX 形式、十進位值和原始 UTF-8 位元組——emoji、漢字和控制字元都包括在內,最多顯示前 200 個。
專治亂碼解碼難題
當 JSON 酬載裡顯示的是 \u4f60\u597d 而不是文字時,貼進來就能讀出真實字串;把亂碼輸出轉成轉義序列,也能看清究竟是哪些位元組出了問題。
常見問題
碼點和UTF-16碼元有什麼區別?⌄
大多數字元占1個16位元碼元,但基本多文種平面之外的字元(例如很多表情符號)需要2個——即「代理對」。檢視器是按碼點讀取的,所以這類字元會正確顯示為一行,而不是兩行。
為什麼會需要 \uXXXX 逸出序列?⌄
這是在JSON字串、JavaScript字串字面值,以及許多不接受原始UTF-8文字的設定/屬性檔案格式中,表示非ASCII字元的標準方式。
我的文字會被上傳嗎?⌄
不會——一切都用純JavaScript在你的瀏覽器裡執行,你輸入的內容永遠不會傳送到伺服器。
為什麼 emoji 在某些日誌裡顯示成兩個怪方塊?⌄
日誌把代理對拆成了兩個獨立轉義(D83D DE00)。任何把它們分開處理的環節都會破壞它;合併起來,或把日誌改為 \u{1F600} 這樣的碼點轉義,表情即可復原。