Unicode-tarkastelu ja escape-muunnin

Muunna teksti Unicode-escape-sekvensseiksi tai pura ne tekstiksi. Tarkista koodipisteet, UTF-8-tavut ja UTF-16-yksiköt myös emojeista ja yhdistyvistä merkeistä.

0 merkkiä
Tulos

Tulos tulee tähän.

Unicoden tarkistaminen ja muuntaminen

  1. Liitä tarkistettava tai koodattava teksti tai purettavat Unicode-escape-sekvenssit.
  2. Valitse koodipisteiden ja tavujen tarkistus, koodaus \uXXXX-muotoon tai purku tekstiksi.
  3. Suorita toiminto ja kopioi tulos. Tarkista myös yhdistyvät merkit ja emojit, kun etsit merkkien välisiä eroja.

Näin käytät työkalua: Unicode-tarkastelu ja escape-muunnin

Emoji voi käyttää kahta UTF-16-koodiyksikköä, ja yksi näkyvä merkki voi koostua useasta koodipisteestä. Työkalu näyttää koodipisteet, ei grafeemiryppäitä. Parittomat surrogaatit hylätään eikä niitä korvata huomaamatta.

Teksti ja emojit Unicode-escape-sekvensseinä

Syöte
Hei maailma! 👋 👋 é
Tulos
\u0048\u0065\u0069\u0020\u006d\u0061\u0061\u0069\u006c\u006d\u0061\u0021\u0020\ud83d\udc4b\u0020\ud83d\udc4b\u0020\u0065\u0301

Kysymyksiä työkalusta: Unicode-tarkastelu ja escape-muunnin

Miksi yksi näkyvä merkki voi viedä useita rivejä?

Kukin rivi vastaa koodipistettä, ei välttämättä kokonaista näkyvää merkkiä. Aksentillinen kirjain voi koostua kirjaimesta ja yhdistyvästä merkistä; emoji voi sisältää useita koodipisteitä, joita yhdistää nollalevyinen liitin. Esimerkiksi é ja e sekä U+0301 voivat näyttää samoilta, vaikka niiden sekvenssit eroavat.

Mitä eroa on koodipisteellä, UTF-8:lla ja UTF-16:lla?

U+1F44B on merkin 👋 koodipiste. UTF-8 esittää sen neljällä tavulla f0 9f 91 8b, UTF-16 kahdella yksiköllä d83d dc4b. JavaScript laskee merkkijonon pituuden UTF-16-yksiköissä, joten tämän emojin pituus on 2, vaikka koodipisteitä on yksi.

Mitä Unicode-escape-sekvenssejä voi purkaa?

Työkalu tukee muotoja \u4e2d ja \u{1F44B} sekä pareja, kuten \ud83d\udc4b. Koodaus tuottaa \uXXXX-sekvenssejä ja täydentäville merkeille parin. Keskeneräiset sekvenssit, Unicode-alueen ulkopuoliset arvot ja parittomat surrogaatit hylätään.

Tulkitseeko työkalu kaikki JavaScript-merkkijonot tai korjaako se väärin näkyvän tekstin?

Ei. Se muuntaa Unicode-escape-sekvenssejä suorittamatta koodia, mutta ei ole täydellinen JavaScript- tai JSON-merkkijonojen jäsennin. \n, \t, \x41 ja U+0041 säilyvät ennallaan. Käytä URL-työkalua arvolle %41 ja HTML-entiteettityökalua arvolle A. Työkalu ei normalisoi tekstiä eikä korjaa väärällä merkistökoodauksella luettua tiedostoa.

Lähetetäänkö tiedostoni, tokenini tai tekstini palvelimelle?

Ei. Työkalut käsittelevät tiedot selaimessasi. Sivusto toimittaa sivun ja ohjelmakoodin, mutta syötettäsi ei lähetetä muunnospalvelimelle eikä tallenneta käyttäjätilille.

  • Base64-koodaus ja purku

    Koodaa UTF-8-teksti Base64-muotoon tai pura tavallinen ja URL-turvallinen Base64. Valitse täytemerkit ja rivipituus.

  • HTML-entiteettien koodaus ja purku

    Muunna teksti HTML-entiteeteiksi tai pura nimetyt ja numeeriset merkkiviittaukset.

  • Tekstien vertailu

    Vertaa kahta tekstiä riveittäin, sanoittain tai merkeittäin ja korosta erot säilyttäen välilyönnit ja rivinvaihdot.

Yleiset tehtävät ja esimerkit

  • Base64-purku

    Pura Base64 luettavaksi UTF-8-tekstiksi tai lataa alkuperäiset tavut.

Kaikki kehittäjätyökalut

Koodaus ja tiedostot

Muunna tekstiä, tavuja, verkko-osoitteita ja upotettuja kuvia alkuperäisiä tietoja muuttamatta.

Tietojen ja tekstin tarkastelu

Lue rakenteista dataa ja tokeneita ja selvitä tarkasti, mikä muuttui.

Tiivisteet, tunnisteet ja ajastukset

Tarkista tiedostoja, luo tunnisteita ja tutki ajankohtia ja toistuvia ajastuksia.

Teksti ja tiedostot käsitellään omalla laitteellasi. Älä jätä luottamuksellisia tuloksia jaetulle leikepöydälle. Käytä yksityisten avainten ja tokenien käsittelyyn luotettavaa laitetta.