Analýza Unicode a převod escape sekvencí

Převeďte text na Unicode escape sekvence a zpět. Zkontrolujte kódové body, bajty UTF-8 a jednotky UTF-16 včetně emoji a kombinujících znaků.

0 znaků
Výsledek

Zde se zobrazí výsledek.

Jak zkontrolovat a převést Unicode

  1. Vložte text ke kontrole či kódování nebo Unicode escape sekvence k dekódování.
  2. Vyberte kontrolu kódových bodů a bajtů, kódování do \uXXXX nebo dekódování na text.
  3. Spusťte nástroj a zkopírujte výsledek. Při porovnávání znaků zkontrolujte také kombinující znaky a emoji.

Analýza Unicode a převod escape sekvencí: co je dobré vědět

Emoji může zabírat dvě jednotky UTF-16 a jeden viditelný symbol může obsahovat více kódových bodů. Nástroj ukazuje kódové body, nikoli grafémové shluky. Nespárované zástupné kódy odmítá, místo aby je tiše nahradil.

Text a emoji jako Unicode escape sekvence

Vstup
Ahoj, světe! 👋 👋 é
Výsledek
\u0041\u0068\u006f\u006a\u002c\u0020\u0073\u0076\u011b\u0074\u0065\u0021\u0020\ud83d\udc4b\u0020\ud83d\udc4b\u0020\u0065\u0301

Analýza Unicode a převod escape sekvencí: otázky a odpovědi

Proč může jeden viditelný znak zabírat několik řádků?

Každý řádek představuje kódový bod, nikoli nutně celý viditelný symbol. Písmeno s diakritikou může sestávat z písmene a znaménka; emoji může obsahovat více bodů propojených spojovníkem s nulovou šířkou. Například é a e s U+0301 mohou vypadat stejně, ale mít různé posloupnosti.

Jak se liší kódový bod, UTF-8 a UTF-16?

U+1F44B označuje 👋. UTF-8 jej zapisuje čtyřmi bajty f0 9f 91 8b, UTF-16 dvěma jednotkami d83d dc4b. JavaScript počítá délku řetězce v jednotkách UTF-16, takže toto emoji má délku 2, přestože jde o jediný kódový bod.

Jaké Unicode escape sekvence lze dekódovat?

Nástroj podporuje \u4e2d, \u{1F44B} a dvojice jako \ud83d\udc4b. Kódování vytváří sekvence \uXXXX, pro doplňkové znaky vždy dvojici. Neúplné sekvence, hodnoty mimo rozsah Unicode a nespárované náhradní jednotky se odmítnou.

Zpracuje nástroj libovolný řetězec JavaScriptu nebo opraví rozsypaný text?

Ne. Převádí Unicode escape sekvence bez spouštění kódu, ale není úplným parserem řetězců JavaScriptu či JSON. \n, \t, \x41 a U+0041 zůstávají beze změny. Pro %41 použijte nástroj URL a pro A nástroj HTML entit. Text se nenormalizuje a chyby způsobené načtením souboru v nesprávném kódování se neopravují.

Odesílají se moje soubory, tokeny nebo text na server?

Ne. Vstup se zpracovává ve vašem prohlížeči. Web poskytuje stránku a programový kód, ale vaše data neodesílá na převodní server ani je neukládá do účtu.

  • Kodér a dekodér Base64

    Převeďte text UTF-8 do Base64 nebo dekódujte standardní i URL bezpečnou variantu. Nastavte výplň a zalamování řádků.

  • Kodér a dekodér HTML entit

    Převádějte text a znaky Unicode na HTML entity nebo dekódujte pojmenované a číselné odkazy na znaky.

  • Porovnání textů

    Porovnejte dva texty po řádcích, slovech nebo znacích. Zvýrazněte přidané a odstraněné části včetně mezer a konců řádků.

Běžné úlohy a příklady

  • Dekodér Base64

    Dekódujte Base64 na čitelný text UTF-8 nebo stáhněte původní bajty.

Všechny vývojářské nástroje

Kódování a soubory

Převádějte text, bajty, URL a vložené obrázky bez změny původních dat.

Kontrola dat a textu

Čtěte strukturovaná data, prohlížejte tokeny a hledejte rozdíly mezi texty.

Hashe, identifikátory a plánování

Ověřujte integritu souborů, vytvářejte identifikátory a pracujte s časem i opakovanými úlohami.

Vstup a soubory se zpracovávají na vašem zařízení. Nenechávejte citlivé výsledky ve sdílené schránce. Pro práci se soukromými klíči a tokeny používejte důvěryhodné zařízení.