Unicode-Konverter
Text ↔ \uXXXX-Escapes, plus ein Zeichen-für-Zeichen-Codepunkt-Inspektor
| Zeichen | Codepunkt | UTF-8-Bytes |
|---|
Was ist ein Unicode-Konverter?
Hinter jedem Zeichen auf dem Bildschirm steckt ein numerischer Codepoint — Buchstabe, Emoji und chinesisches Schriftzeichen haben jeweils einen eigenen — und UTF-8 kodiert diese Codepoints in Bytes. Meist sieht man diese Ebene nie, doch sie taucht in maskierten JSON-Strings, Zeichensalat und Encoding-Bugs auf. Dieses Tool wandelt Text in \uXXXX-Escape-Sequenzen um und zurück und inspiziert jedes Zeichen auf Codepoint, Dezimalwert und rohe UTF-8-Bytes — alles live beim Tippen. Es richtet sich an Entwickler, Übersetzer und alle, die schon einmal vor einem unlesbaren String gestanden haben.
Was dekodiert und inspiziert wird
- 🔄 Text in \uXXXX-Escape-Sequenzen und zurück
- 🔍 Zeichen-Inspektor: Codepoint U+XXXX, Dezimalwert und UTF-8-Bytes
- 🔢 Behandelt Zeichen jenseits der Basic Multilingual Plane wie Emojis codepoint-genau
- ⚡ Ergebnisse aktualisieren sich live beim Tippen
Wann die Encoding-Ebene zählt
- Einen String debuggen, der in E-Mail oder Datenbank als Kauderwelsch erscheint
- JSON von Hand mit Escape-Sequenzen für Nicht-ASCII-Text schreiben
- Verstehen, warum ein Emoji oder CJK-Zeichen ein Altsystem stört
- Prüfen, welche Bytes eine Datei für ein bestimmtes Zeichen tatsächlich speichert
Alles läuft lokal in Ihrem Browser; es wird kein Text hochgeladen. Maskiert werden nur Nicht-ASCII- und Steuerzeichen, sodass reiner ASCII-Output lesbar bleibt.
Zuletzt aktualisiert · 2026-09-01
Codepoints, Surrogaten und UTF-8-Breiten
- U+1F600 ist ein Zeichen, zwei UTF-16-Einheiten (Surrogatpaar), vier UTF-8-Bytes — drei Längen für einen Emoji.
- \uXXXX kodiert UTF-16; \u{...} volle Codepoints — in der falschen Sprache zerlegt sich der Emoji still.
- Die Byte-Ansicht zeigt genau, was Speicher- und Netzwerkschicht sehen.
Ein Zeichen ist kein Byte
Escapes in beide Richtungen
Klartext wird zu \uXXXX-Sequenzen mit vierstelligem Hexadezimalwert in Großschreibung, während druckbare ASCII-Zeichen unangetastet bleiben; eingefügte Escapes wandelt der Rückweg wieder in Zeichen um.
Zeichen-für-Zeichen-Inspektor
Jeder Codepunkt in Ihrer Zeichenkette erscheint mit seiner U+XXXX-Form, seinem Dezimalwert und seinen rohen UTF-8-Bytes – Emojis, chinesische Zeichen und Steuerzeichen inklusive, bis zu den ersten 200.
Zum Entziffern von Mojibake
Zeigt ein JSON-Payload \u4f60\u597d statt Text, fügen Sie es hier ein, um die echte Zeichenkette zu lesen, oder wandeln Sie jede verstümmelte Ausgabe in Escapes um, um zu sehen, welche Bytes falsch sind.
Häufige Fragen
Was ist der Unterschied zwischen einem Codepunkt und einer UTF-16-Codeeinheit?⌄
Die meisten Zeichen passen in eine 16-Bit-Codeeinheit, aber Zeichen außerhalb der Basic Multilingual Plane (viele Emojis zum Beispiel) benötigen zwei — ein "Surrogatpaar". Der Inspektor liest nach Codepunkt, sodass diese korrekt als eine Zeile erscheinen, nicht zwei.
Wofür würde ich \uXXXX-Escapes benötigen?⌄
Sie sind die Standardmethode zur Darstellung von Nicht-ASCII-Zeichen in JSON-Zeichenketten, JavaScript-Zeichenkettenliteralen und vielen Konfigurations-/Eigenschaftsdateiformaten, die kein rohes UTF-8 akzeptieren.
Wird mein Text irgendwohin hochgeladen?⌄
Nein — alles läuft in Ihrem Browser mit reinem JavaScript. Nichts, was Sie eingeben, wird jemals an einen Server gesendet.
Warum zeigt mein Log zwei seltsame Kästchen statt des Emoji?⌄
Der Logger hat das Surrogatpaar als zwei getrennte Escapes gedruckt (D83D DE00). Alles, was sie einzeln behandelt, zerbricht das Paar; zusammenfügen — oder der Logger auf Codepoint-Escapes wie \u{1F600} umstellen — dann kehrt das Gesicht zurück.
Ähnliche Tools
Ähnliche Tools
Textzähler
Live-Wort-, Zeichen-, Zeilen-, Absatz- und Satzanzahl plus Lesezeit
Textzeilen-Tools
Doppelte oder leere Zeilen entfernen, trimmen, sortieren und umkehren — alles in einem Durchgang
Groß-/Kleinschreibung
GROSSBUCHSTABEN, Kleinbuchstaben, Title Case, camelCase, snake_case und mehr