Unicode-inspeksjon og escape-konvertering

Konverter tekst til Unicode-escapes eller tilbake til lesbar tekst. Se kodepunkter, UTF-8-byte og UTF-16-enheter for bokstaver, emoji og kombinerende tegn.

0 tegn
Resultat

Resultatet vises her.

Slik undersøker og konverterer du Unicode

  1. Lim inn tekst som skal undersøkes eller kodes, eller Unicode-escapes som skal dekodes.
  2. Velg visning av kodepunkter og byte, koding til \uXXXX eller dekoding tilbake til tekst.
  3. Kjør verktøyet og kopier resultatet. Se etter kombinerende tegn og emoji når du sammenligner tegn.

Slik bruker du Unicode-inspeksjon og escape-konvertering

En emoji kan bruke to UTF-16-enheter, og ett synlig tegn kan bestå av flere kodepunkter. Verktøyet viser kodepunkter, ikke grafemklynger. Surrogater uten partner avvises i stedet for å erstattes i det skjulte.

Tekst og emoji som Unicode-escapes

Inndata
Hei, verden! 👋 👋 é
Resultat
\u0048\u0065\u0069\u002c\u0020\u0076\u0065\u0072\u0064\u0065\u006e\u0021\u0020\ud83d\udc4b\u0020\ud83d\udc4b\u0020\u0065\u0301

Spørsmål om Unicode-inspeksjon og escape-konvertering

Hvorfor kan ett synlig tegn gi flere rader?

Hver rad er ett kodepunkt, ikke nødvendigvis et helt synlig tegn. En bokstav med aksent kan bestå av bokstav og aksenttegn; emoji kan bestå av flere kodepunkter koblet med et sammenføyningstegn uten bredde. é og e med U+0301 kan for eksempel se like ut, men ha ulik tegnsekvens.

Hva er forskjellen på kodepunkter, UTF-8 og UTF-16?

U+1F44B identifiserer 👋. UTF-8 bruker fire byte, f0 9f 91 8b; UTF-16 bruker to enheter, d83d dc4b. JavaScript måler strenglengde i UTF-16-enheter, så denne emojien har lengde 2, selv om den er ett kodepunkt.

Hvilke Unicode-escapes kan dekodes?

Verktøyet godtar \u4e2d, \u{1F44B} og par som \ud83d\udc4b. Koding gir \uXXXX-sekvenser, med et par for tegn utenfor grunnplanet. Ufullstendige escapes, verdier utenfor Unicode-området og uparrede surrogater avvises.

Tolker verktøyet alle JavaScript-strenger eller retter ødelagt tekst?

Nei. Det konverterer Unicode-escapes uten å kjøre kode, men er ikke en fullstendig strengparser for JavaScript eller JSON. \n, \t, \x41 og U+0041 beholdes uendret. Bruk URL-verktøyet for %41 og HTML-entitetsverktøyet for A. Teksten normaliseres ikke, og feil filtegnkoding repareres ikke.

Blir filene, tokenene eller teksten min lastet opp?

Nei. Verktøyene behandler inndata i nettleseren din. Nettstedet leverer siden og programkoden, men sender ikke innholdet til en konverteringsserver og lagrer det ikke på en konto.

Vanlige oppgaver og eksempler

  • Base64-dekoder

    Dekod Base64 til lesbar UTF-8-tekst, eller last ned de opprinnelige bytene.

Alle utviklerverktøy

Koding og filer

Konverter tekst, byte, nettadresser og innebygde bilder uten å endre de opprinnelige dataene.

Analyse av data og tekst

Les strukturerte data og tokener, og se nøyaktig hva som er endret.

Hash, ID-er og tidsplaner

Kontroller filer, lag identifikatorer og se tidspunkter og gjentakende kjøringer.

Tekst og filer behandles på enheten din. Ikke la fortrolige resultater ligge på en delt utklippstavle, og bruk en enhet du stoler på til private nøkler og tokener.