Unicode-Inspektor und Escape-Konverter

Text in Unicode-Escapes umwandeln und zurückdekodieren. Codepoints, UTF-8-Bytes und UTF-16-Einheiten für Zeichen, Emojis und kombinierende Zeichen prüfen.

0 Zeichen
Ergebnis

Hier erscheint Ihr Ergebnis.

Unicode untersuchen und umwandeln

  1. Text zum Untersuchen oder Kodieren einfügen; zum Dekodieren Unicode-Escapes einfügen.
  2. Codepoints und Bytes untersuchen, in \uXXXX kodieren oder Escapes in Text zurückwandeln.
  3. Werkzeug ausführen und Ergebnis kopieren. Beim Zeichenvergleich auch kombinierende Zeichen und Emojis beachten.

Wissenswertes zu Unicode-Inspektor und Escape-Konverter

Ein Emoji kann zwei UTF-16-Einheiten belegen, ein sichtbares Zeichen aus mehreren Codepunkten bestehen. Das Tool zeigt Codepunkte, keine Graphemcluster. Ungepaarte Surrogate werden abgewiesen und nicht unbemerkt ersetzt.

Text und Emojis als Unicode-Escapes

Eingabe
Hallo, Welt! 👋 👋 é
Ergebnis
\u0048\u0061\u006c\u006c\u006f\u002c\u0020\u0057\u0065\u006c\u0074\u0021\u0020\ud83d\udc4b\u0020\ud83d\udc4b\u0020\u0065\u0301

Fragen zu Unicode-Inspektor und Escape-Konverter

Warum kann ein sichtbares Zeichen mehrere Zeilen belegen?

Eine Zeile entspricht einem Codepoint, nicht unbedingt einem vollständigen sichtbaren Zeichen. Ein Akzentbuchstabe kann aus Buchstabe und Akzent bestehen; Emojis können mehrere Codepoints mit einem breitenlosen Verbinder verknüpfen. é und e mit U+0301 können etwa gleich aussehen, haben aber unterschiedliche Zeichenfolgen.

Was unterscheidet Codepoints, UTF-8 und UTF-16?

U+1F44B bezeichnet 👋. UTF-8 verwendet dafür vier Bytes, f0 9f 91 8b; UTF-16 zwei Einheiten, d83d dc4b. JavaScript zählt bei der Stringlänge UTF-16-Einheiten. Dieses Emoji hat deshalb die Länge 2, obwohl es nur ein Codepoint ist.

Welche Unicode-Escapes lassen sich dekodieren?

Unterstützt werden \u4e2d, \u{1F44B} und Paare wie \ud83d\udc4b. Die Kodierung erzeugt \uXXXX-Sequenzen, bei ergänzenden Zeichen jeweils ein Paar. Unvollständige Escapes, Werte außerhalb des Unicode-Bereichs und ungepaarte Surrogate werden abgewiesen.

Analysiert das Werkzeug beliebige JavaScript-Strings oder repariert Zeichensalat?

Nein. Es wandelt Unicode-Escapes um, ohne Code auszuführen, ist aber kein vollständiger JavaScript- oder JSON-Stringparser. \n, \t, \x41 und U+0041 bleiben unverändert. Für %41 gibt es das URL-Werkzeug, für A das HTML-Entity-Werkzeug. Zeichen werden weder normalisiert noch Fehler durch falsch gelesene Dateikodierungen repariert.

Werden meine Dateien, Tokens oder Texte hochgeladen?

Nein. Ihre Eingaben werden im Browser verarbeitet. Die Website liefert die Seite und den Programmcode, sendet Ihre Eingaben aber weder an einen Konvertierungsserver noch speichert sie diese in einem Konto.

  • Base64-Encoder und -Decoder

    UTF-8-Text in Base64 kodieren oder Standard- und URL-sicheres Base64 dekodieren, mit einstellbarer Auffüllung und Zeilenlänge.

  • HTML-Entitäten kodieren und dekodieren

    Text und Unicode-Zeichen in HTML-Entitäten umwandeln sowie benannte und numerische Zeichenreferenzen dekodieren.

  • Textvergleich und Diff

    Zwei Texte nach Zeilen, Wörtern oder Zeichen vergleichen und Ergänzungen und Löschungen samt Leerzeichen hervorheben.

Häufige Aufgaben und Beispiele

  • Base64-Decoder

    Dekodiere Base64 zu lesbarem UTF-8-Text oder lade die ursprünglichen Bytes herunter.

Alle Entwicklerwerkzeuge

Kodierung und Dateien

Zwischen Text, Bytes, URLs und eingebetteten Bildern umwandeln, ohne die ursprünglichen Daten zu verändern.

Daten und Texte prüfen

Strukturierte Daten und Tokens lesen und Änderungen genau nachvollziehen.

Hashes, IDs und Zeitpläne

Dateien prüfen, Kennungen erzeugen sowie Zeitangaben und wiederkehrende Termine verstehen.

Eingaben und Dateien werden auf Ihrem Gerät verarbeitet. Lassen Sie vertrauliche Ergebnisse nicht in einer gemeinsam genutzten Zwischenablage und verwenden Sie für private Schlüssel und Tokens ein vertrauenswürdiges Gerät.