Analizator Unicode i konwerter sekwencji

Zamieniaj tekst na sekwencje Unicode i dekoduj je z powrotem. Sprawdzaj punkty kodowe, bajty UTF-8 oraz jednostki UTF-16, także dla emoji i znaków łączących.

0 znaków
Wynik

Tutaj pojawi się wynik.

Jak sprawdzać i konwertować Unicode

  1. Wklej tekst do sprawdzenia lub zakodowania albo sekwencje Unicode do dekodowania.
  2. Wybierz podgląd punktów kodowych i bajtów, kodowanie do \uXXXX lub dekodowanie do tekstu.
  3. Uruchom narzędzie i skopiuj wynik. Przy porównywaniu znaków zwróć uwagę na znaki łączące i emoji.

Analizator Unicode i konwerter sekwencji: co warto wiedzieć

Emoji może zajmować dwie jednostki UTF-16, a jeden widoczny symbol może zawierać kilka punktów kodowych. Narzędzie pokazuje punkty kodowe, a nie klastry grafemowe. Odrzuca niesparowane surogaty zamiast po cichu je zastępować.

Tekst i emoji jako sekwencje ucieczki Unicode

Dane wejściowe
Witaj, świecie! 👋 👋 é
Wynik
\u0057\u0069\u0074\u0061\u006a\u002c\u0020\u015b\u0077\u0069\u0065\u0063\u0069\u0065\u0021\u0020\ud83d\udc4b\u0020\ud83d\udc4b\u0020\u0065\u0301

Analizator Unicode i konwerter sekwencji: pytania i odpowiedzi

Dlaczego jeden widoczny znak może zajmować kilka wierszy?

Każdy wiersz oznacza punkt kodowy, niekoniecznie cały widoczny symbol. Litera z akcentem może składać się z litery i znaku łączącego, a emoji z kilku punktów połączonych łącznikiem o zerowej szerokości. Na przykład é i e z U+0301 mogą wyglądać tak samo, choć mają różne sekwencje.

Czym różnią się punkt kodowy, UTF-8 i UTF-16?

U+1F44B oznacza 👋. UTF-8 zapisuje go jako cztery bajty f0 9f 91 8b, a UTF-16 jako dwie jednostki d83d dc4b. JavaScript liczy długość ciągu w jednostkach UTF-16, więc to emoji ma długość 2, mimo że jest jednym punktem kodowym.

Jakie sekwencje Unicode można dekodować?

Narzędzie obsługuje \u4e2d, \u{1F44B} oraz pary takie jak \ud83d\udc4b. Kodowanie tworzy sekwencje \uXXXX, po dwie dla znaków dodatkowych. Niepełne sekwencje, wartości spoza zakresu Unicode i niesparowane surogaty są odrzucane.

Czy narzędzie analizuje dowolny ciąg JavaScript lub naprawia „krzaczki”?

Nie. Konwertuje sekwencje Unicode bez wykonywania kodu, ale nie jest pełnym parserem ciągów JavaScript lub JSON. Nie zmienia \n, \t, \x41 ani U+0041. Dla %41 użyj narzędzia URL, a dla A narzędzia encji HTML. Nie normalizuje tekstu ani nie naprawia błędów wynikających z odczytu pliku w niewłaściwym kodowaniu.

Czy pliki, tokeny lub tekst są wysyłane na serwer?

Nie. Dane są przetwarzane w Twojej przeglądarce. Witryna udostępnia stronę i kod programu, ale nie wysyła danych do serwera konwersji ani nie zapisuje ich na koncie.

  • Koder i dekoder Base64

    Koduj tekst UTF-8 do Base64 lub dekoduj standardowy i bezpieczny dla URL wariant. Ustaw dopełnienie i zawijanie wierszy.

  • Koder i dekoder encji HTML

    Zamieniaj tekst i znaki Unicode na encje HTML lub dekoduj nazwane i numeryczne odwołania do znaków.

  • Porównywarka tekstów

    Porównuj dwa teksty według wierszy, słów lub znaków. Znajduj dodatki i usunięcia z uwzględnieniem spacji i nowych wierszy.

Typowe zadania i przykłady

  • Dekoder Base64

    Odkoduj Base64 do czytelnego tekstu UTF-8 lub pobierz oryginalne bajty.

Wszystkie narzędzia programistyczne

Kodowanie i pliki

Przekształcaj tekst, bajty, adresy URL i osadzone obrazy bez zmiany oryginalnych danych.

Analiza danych i tekstu

Czytaj dane strukturalne, sprawdzaj tokeny i znajduj różnice między tekstami.

Skróty, identyfikatory i harmonogramy

Sprawdzaj integralność plików, generuj identyfikatory i analizuj znaczniki czasu oraz cykliczne zadania.

Dane i pliki są przetwarzane na Twoim urządzeniu. Nie zostawiaj poufnych wyników we współdzielonym schowku. Do pracy z kluczami prywatnymi i tokenami używaj zaufanego urządzenia.