Анализ Unicode и преобразование escape-последовательностей

Преобразуйте текст в Unicode-последовательности и обратно. Проверяйте кодовые точки, байты UTF-8 и единицы UTF-16, включая эмодзи и комбинируемые знаки.

0 символов
Результат

Здесь появится результат.

Как проверить и преобразовать Unicode

  1. Вставьте текст для проверки или кодирования либо Unicode-последовательности для декодирования.
  2. Выберите просмотр кодовых точек и байтов, кодирование в \uXXXX или восстановление текста.
  3. Запустите инструмент и скопируйте результат. При поиске различий проверьте комбинируемые знаки и составные эмодзи.

Анализ Unicode и преобразование escape-последовательностей: что важно знать

Эмодзи может занимать две единицы UTF-16, а один видимый символ — состоять из нескольких кодовых точек. Инструмент показывает именно кодовые точки, а не графемные кластеры. Непарные суррогаты отклоняются, а не заменяются незаметно.

Текст и эмодзи в виде Unicode-последовательностей

Исходные данные
Привет, мир! 👋 👋 é
Результат
\u041f\u0440\u0438\u0432\u0435\u0442\u002c\u0020\u043c\u0438\u0440\u0021\u0020\ud83d\udc4b\u0020\ud83d\udc4b\u0020\u0065\u0301

Анализ Unicode и преобразование escape-последовательностей: вопросы и ответы

Почему один видимый символ занимает несколько строк?

Каждая строка соответствует кодовой точке, а не обязательно целому видимому символу. Буква с диакритикой может состоять из буквы и знака, а эмодзи — из нескольких точек, соединённых символом нулевой ширины. Например, é и e с U+0301 могут выглядеть одинаково, но иметь разные последовательности.

Чем кодовая точка отличается от UTF-8 и UTF-16?

U+1F44B обозначает 👋. В UTF-8 это четыре байта: f0 9f 91 8b; в UTF-16 — две единицы: d83d dc4b. JavaScript считает длину строки в единицах UTF-16, поэтому длина этого эмодзи равна 2, хотя кодовая точка одна.

Какие Unicode-последовательности можно декодировать?

Поддерживаются \u4e2d, \u{1F44B} и пары вроде \ud83d\udc4b. Кодирование выдаёт последовательности \uXXXX, для дополнительных символов — пару. Неполные последовательности, значения вне диапазона Unicode и непарные суррогаты отклоняются.

Инструмент разбирает любые строки JavaScript и исправляет «кракозябры»?

Нет. Он преобразует Unicode-последовательности без выполнения кода, но не является полноценным парсером строк JavaScript или JSON. \n, \t, \x41 и U+0041 остаются без изменений. Для %41 используйте инструмент URL, для A — HTML-сущности. Нормализация текста и исправление неверно прочитанной кодировки файла не выполняются.

Мои файлы, токены и текст отправляются на сервер?

Нет. Данные обрабатываются в вашем браузере. Сайт загружает страницу и программный код, но не отправляет ваши данные на сервер преобразования и не сохраняет их в учётной записи.

Частые задачи и примеры

  • Декодер Base64

    Преобразуйте Base64 в читаемый текст UTF-8 или скачайте исходные байты.

Все инструменты разработчика

Кодирование и файлы

Преобразуйте текст, байты, URL и встроенные изображения без изменения исходных данных.

Кодирование и декодирование Base64

Кодируйте текст UTF-8 в Base64 или декодируйте обычный и URL-безопасный Base64. Настраивайте заполнение и переносы строк.

Кодирование и декодирование Base64URL

Преобразуйте текст в URL-безопасный Base64 с символами - и _. Кодируйте и декодируйте Base64URL без заполнения.

Изображение в Base64

Преобразуйте PNG, JPEG, GIF, WebP, SVG и другие распознаваемые изображения в Base64 Data URI прямо в браузере.

Base64 в изображение

Декодируйте изображения из Base64 и Data URI, просматривайте поддерживаемые форматы и скачивайте исходные байты изображения.

Файл в Base64

Преобразуйте любой файл в строку Base64. При необходимости добавьте префикс Data URI, заполнение или переносы строк MIME.

Base64 в файл

Преобразуйте строки Base64 и Data URI в скачиваемые файлы, сохранив декодированные двоичные данные без изменений.

Кодирование и декодирование URL

Кодируйте и декодируйте компоненты URL, полные адреса и значения форм. Корректно обрабатывайте процентную кодировку и пробелы.

Кодирование и декодирование HTML-сущностей

Преобразуйте текст и символы Unicode в HTML-сущности. Декодируйте именованные и числовые ссылки на символы.

Проверка данных и текста

Изучайте структуру данных и содержимое токенов, находите различия между текстами.

Хеши, идентификаторы и расписания

Проверяйте целостность файлов, создавайте идентификаторы и разбирайтесь во временных метках и расписаниях.

MD5: хеш текста и контрольная сумма файла

Вычисляйте MD5 для текста или локального файла и сравнивайте результат с ожидаемой контрольной суммой.

SHA-1: хеш текста и контрольная сумма файла

Вычисляйте SHA-1 для текста UTF-8 и файлов, затем сравнивайте результат с ожидаемой контрольной суммой.

SHA-256: хеш текста и контрольная сумма файла

Вычисляйте SHA-256 для текста и файлов. Проверяйте скачанные файлы по опубликованным контрольным суммам.

SHA-512: хеш текста и контрольная сумма файла

Вычисляйте SHA-512 для текста и файлов на своём устройстве и сравнивайте полные шестнадцатеричные значения.

Калькулятор контрольной суммы CRC32

Вычисляйте стандартную CRC-32 для текста и файлов, сравнивайте восьмизначные шестнадцатеричные результаты.

Генератор HMAC

Вычисляйте HMAC-SHA-1, HMAC-SHA-256 и HMAC-SHA-512 с секретным ключом в UTF-8 или шестнадцатеричном виде.

Генератор UUID и GUID

Создавайте случайные UUID v4 и упорядоченные по времени UUID v7 по одному или пакетами.

Конвертер временных меток Unix

Преобразуйте секунды Unix, миллисекунды и даты ISO 8601. Просматривайте один и тот же момент в UTC или любом часовом поясе IANA.

Разбор выражений Cron

Проверяйте выражения Cron из пяти или шести полей. Просматривайте ближайшие запуски в часовом поясе IANA с учётом перехода на летнее время.

Генератор выражений Cron

Составляйте выражения Cron из временных полей или готовых вариантов и просматривайте ближайшие запуски в выбранном часовом поясе.

Текст и файлы обрабатываются на вашем устройстве. Не оставляйте конфиденциальные результаты в общем буфере обмена. Для работы с закрытыми ключами и токенами используйте доверенное устройство.