Unicode analyseren en escapes omzetten

Zet tekst om naar Unicode-escapes of decodeer JavaScript-sequenties. Bekijk codepunten, UTF-8-bytes en UTF-16-eenheden voor tekst, emoji en combinatietekens.

0 tekens
Resultaat

Het resultaat verschijnt hier.

Unicode bekijken en omzetten

  1. Plak tekst om te bekijken of te coderen, of Unicode-escapes om te decoderen.
  2. Kies codepunten en bytes bekijken, coderen naar \uXXXX of decoderen naar leesbare tekst.
  3. Voer de bewerking uit en kopieer het resultaat. Let bij tekenverschillen op combinatietekens en emoji.

Aan de slag met Unicode analyseren en escapes omzetten

Een emoji kan twee UTF-16-eenheden innemen en een zichtbaar teken kan uit meerdere codepunten bestaan. De tool toont codepunten, geen grafeemclusters. Losse surrogaten worden geweigerd in plaats van stilzwijgend vervangen.

Tekst en emoji als Unicode-escapes

Invoer
Hallo wereld! 👋 👋 é
Resultaat
\u0048\u0061\u006c\u006c\u006f\u0020\u0077\u0065\u0072\u0065\u006c\u0064\u0021\u0020\ud83d\udc4b\u0020\ud83d\udc4b\u0020\u0065\u0301

Vragen over Unicode analyseren en escapes omzetten

Waarom kan één zichtbaar teken meerdere rijen opleveren?

Elke rij stelt één codepunt voor, niet noodzakelijk een volledig zichtbaar teken. Een letter met accent kan uit een letter en een combinatieteken bestaan; emoji kunnen meerdere codepunten met een verbindend teken zonder breedte combineren. Zo kunnen é en e met U+0301 er hetzelfde uitzien, maar verschillende reeksen bevatten.

Wat is het verschil tussen codepunten, UTF-8 en UTF-16?

U+1F44B staat voor 👋. UTF-8 gebruikt vier bytes, f0 9f 91 8b; UTF-16 gebruikt twee eenheden, d83d dc4b. JavaScript telt UTF-16-eenheden bij de tekenreekslengte. Deze emoji heeft daarom lengte 2, hoewel het één codepunt is.

Welke Unicode-escapes kan ik decoderen?

De decoder accepteert \u4e2d, \u{1F44B} en paren zoals \ud83d\udc4b. Coderen levert \uXXXX-reeksen op, met een paar voor aanvullende tekens. Onvolledige escapes, waarden buiten het Unicode-bereik en ongepaarde surrogaten worden geweigerd.

Ontleedt de tool alle JavaScript-strings of herstelt hij onleesbare tekst?

Nee. De tool zet Unicode-escapes om zonder code uit te voeren, maar is geen volledige parser voor JavaScript- of JSON-strings. \n, \t, \x41 en U+0041 blijven ongewijzigd. Gebruik de URL-tool voor %41 en de HTML-entiteitentool voor A. De tool normaliseert tekst niet en herstelt geen verkeerd gelezen bestandscodering.

Worden mijn bestanden, tokens of teksten geüpload?

Nee. De verwerking vindt plaats in je browser. De website levert de pagina en de programmacode, maar stuurt je invoer niet naar een conversieserver en slaat die niet op in een account.

Veelgebruikte taken en voorbeelden

  • Base64-decoder

    Decodeer Base64 naar leesbare UTF-8-tekst of download de oorspronkelijke bytes.

Alle ontwikkelaarstools

Codering en bestanden

Zet tekst, bytes, URL’s en ingesloten afbeeldingen om zonder de oorspronkelijke gegevens te veranderen.

Gegevens en tekst analyseren

Bekijk gestructureerde gegevens en tokens en zie precies wat er is veranderd.

Hashes, ID’s en schema’s

Controleer bestanden, genereer identificatiecodes en bekijk tijden en terugkerende uitvoeringen.

Je invoer en bestanden worden op je eigen apparaat verwerkt. Laat vertrouwelijke resultaten niet op een gedeeld klembord staan en gebruik een betrouwbaar apparaat voor privésleutels en tokens.