tomai
Anmelden
Kostenlos · Text-Tools

Unicode-Konverter

Text ↔ \uXXXX-Escapes, plus ein Zeichen-für-Zeichen-Codepunkt-Inspektor

Text
Unicode-Escapes
Zeicheninspektor
Zeichen Codepunkt UTF-8-Bytes

Was ist ein Unicode-Konverter?

Hinter jedem Zeichen auf dem Bildschirm steckt ein numerischer Codepoint — Buchstabe, Emoji und chinesisches Schriftzeichen haben jeweils einen eigenen — und UTF-8 kodiert diese Codepoints in Bytes. Meist sieht man diese Ebene nie, doch sie taucht in maskierten JSON-Strings, Zeichensalat und Encoding-Bugs auf. Dieses Tool wandelt Text in \uXXXX-Escape-Sequenzen um und zurück und inspiziert jedes Zeichen auf Codepoint, Dezimalwert und rohe UTF-8-Bytes — alles live beim Tippen. Es richtet sich an Entwickler, Übersetzer und alle, die schon einmal vor einem unlesbaren String gestanden haben.

Was dekodiert und inspiziert wird

  • 🔄 Text in \uXXXX-Escape-Sequenzen und zurück
  • 🔍 Zeichen-Inspektor: Codepoint U+XXXX, Dezimalwert und UTF-8-Bytes
  • 🔢 Behandelt Zeichen jenseits der Basic Multilingual Plane wie Emojis codepoint-genau
  • ⚡ Ergebnisse aktualisieren sich live beim Tippen

Wann die Encoding-Ebene zählt

  • Einen String debuggen, der in E-Mail oder Datenbank als Kauderwelsch erscheint
  • JSON von Hand mit Escape-Sequenzen für Nicht-ASCII-Text schreiben
  • Verstehen, warum ein Emoji oder CJK-Zeichen ein Altsystem stört
  • Prüfen, welche Bytes eine Datei für ein bestimmtes Zeichen tatsächlich speichert

Alles läuft lokal in Ihrem Browser; es wird kein Text hochgeladen. Maskiert werden nur Nicht-ASCII- und Steuerzeichen, sodass reiner ASCII-Output lesbar bleibt.

Zuletzt aktualisiert · 2026-09-01

Codepoints, Surrogaten und UTF-8-Breiten

  • U+1F600 ist ein Zeichen, zwei UTF-16-Einheiten (Surrogatpaar), vier UTF-8-Bytes — drei Längen für einen Emoji.
  • \uXXXX kodiert UTF-16; \u{...} volle Codepoints — in der falschen Sprache zerlegt sich der Emoji still.
  • Die Byte-Ansicht zeigt genau, was Speicher- und Netzwerkschicht sehen.

Ein Zeichen ist kein Byte

Escapes in beide Richtungen

Klartext wird zu \uXXXX-Sequenzen mit vierstelligem Hexadezimalwert in Großschreibung, während druckbare ASCII-Zeichen unangetastet bleiben; eingefügte Escapes wandelt der Rückweg wieder in Zeichen um.

🔒

Zeichen-für-Zeichen-Inspektor

Jeder Codepunkt in Ihrer Zeichenkette erscheint mit seiner U+XXXX-Form, seinem Dezimalwert und seinen rohen UTF-8-Bytes – Emojis, chinesische Zeichen und Steuerzeichen inklusive, bis zu den ersten 200.

🎯

Zum Entziffern von Mojibake

Zeigt ein JSON-Payload \u4f60\u597d statt Text, fügen Sie es hier ein, um die echte Zeichenkette zu lesen, oder wandeln Sie jede verstümmelte Ausgabe in Escapes um, um zu sehen, welche Bytes falsch sind.

Häufige Fragen

Was ist der Unterschied zwischen einem Codepunkt und einer UTF-16-Codeeinheit?

Die meisten Zeichen passen in eine 16-Bit-Codeeinheit, aber Zeichen außerhalb der Basic Multilingual Plane (viele Emojis zum Beispiel) benötigen zwei — ein "Surrogatpaar". Der Inspektor liest nach Codepunkt, sodass diese korrekt als eine Zeile erscheinen, nicht zwei.

Wofür würde ich \uXXXX-Escapes benötigen?

Sie sind die Standardmethode zur Darstellung von Nicht-ASCII-Zeichen in JSON-Zeichenketten, JavaScript-Zeichenkettenliteralen und vielen Konfigurations-/Eigenschaftsdateiformaten, die kein rohes UTF-8 akzeptieren.

Wird mein Text irgendwohin hochgeladen?

Nein — alles läuft in Ihrem Browser mit reinem JavaScript. Nichts, was Sie eingeben, wird jemals an einen Server gesendet.

Warum zeigt mein Log zwei seltsame Kästchen statt des Emoji?

Der Logger hat das Surrogatpaar als zwei getrennte Escapes gedruckt (D83D DE00). Alles, was sie einzeln behandelt, zerbricht das Paar; zusammenfügen — oder der Logger auf Codepoint-Escapes wie \u{1F600} umstellen — dann kehrt das Gesicht zurück.

Ähnliche Tools

Ähnliche Tools