Kiểm tra Unicode và chuyển đổi chuỗi thoát

Chuyển văn bản sang chuỗi escape Unicode hoặc giải mã về chữ. Xem điểm mã, byte UTF-8 và đơn vị UTF-16 của ký tự, emoji và dấu kết hợp.

0 ký tự
Kết quả

Kết quả sẽ xuất hiện ở đây.

Cách kiểm tra và chuyển đổi Unicode

  1. Dán văn bản cần kiểm tra hoặc mã hóa, hay chuỗi escape Unicode cần giải mã.
  2. Chọn xem điểm mã và byte, mã hóa sang \uXXXX hoặc giải mã về văn bản.
  3. Chạy công cụ rồi sao chép kết quả. Khi tìm khác biệt giữa các ký tự, hãy kiểm tra cả dấu kết hợp và emoji.

Tìm hiểu về Kiểm tra Unicode và chuyển đổi chuỗi thoát

Một emoji có thể dùng hai đơn vị UTF-16, còn một ký tự hiển thị có thể gồm nhiều điểm mã. Công cụ hiển thị điểm mã, không coi chúng là cụm ký tự hoàn chỉnh. Đơn vị mã thay thế không có cặp sẽ bị từ chối thay vì âm thầm đổi sang ký tự khác.

Văn bản và emoji ở dạng escape Unicode

Dữ liệu đầu vào
Xin chào thế giới! 👋 👋 é
Kết quả
\u0058\u0069\u006e\u0020\u0063\u0068\u00e0\u006f\u0020\u0074\u0068\u1ebf\u0020\u0067\u0069\u1edb\u0069\u0021\u0020\ud83d\udc4b\u0020\ud83d\udc4b\u0020\u0065\u0301

Câu hỏi thường gặp về Kiểm tra Unicode và chuyển đổi chuỗi thoát

Vì sao một ký tự nhìn thấy lại chiếm nhiều dòng?

Mỗi dòng là một điểm mã, không nhất thiết là một ký tự hoàn chỉnh trên màn hình. Chữ có dấu có thể gồm chữ cái và dấu kết hợp; emoji có thể ghép nhiều điểm mã bằng ký tự nối không độ rộng. Ví dụ, é và e kèm U+0301 có thể trông giống nhau nhưng có chuỗi mã khác nhau.

Điểm mã, UTF-8 và UTF-16 khác nhau thế nào?

U+1F44B là điểm mã của 👋. UTF-8 biểu diễn bằng bốn byte f0 9f 91 8b; UTF-16 dùng hai đơn vị d83d dc4b. JavaScript tính độ dài chuỗi theo đơn vị UTF-16, nên emoji này có độ dài 2 dù chỉ có một điểm mã.

Công cụ giải mã được những dạng escape Unicode nào?

Hỗ trợ \u4e2d, \u{1F44B} và cặp như \ud83d\udc4b. Khi mã hóa, công cụ tạo chuỗi \uXXXX, dùng một cặp cho ký tự bổ sung. Escape chưa đầy đủ, giá trị ngoài phạm vi Unicode và surrogate không có cặp sẽ bị từ chối.

Công cụ có phân tích mọi chuỗi JavaScript hay sửa lỗi font không?

Không. Công cụ chuyển escape Unicode mà không chạy mã, nhưng không phải bộ phân tích đầy đủ cho chuỗi JavaScript hay JSON. \n, \t, \x41 và U+0041 được giữ nguyên. Dùng công cụ URL cho %41 và công cụ thực thể HTML cho A. Công cụ không chuẩn hóa văn bản hay sửa lỗi do đọc sai bảng mã của tệp.

Tệp, token và văn bản của tôi có được tải lên không?

Không. Các công cụ xử lý dữ liệu ngay trong trình duyệt. Trang web chỉ cung cấp giao diện và mã chương trình; dữ liệu của bạn không được gửi tới máy chủ chuyển đổi hay lưu trong tài khoản.

  • Mã hóa và giải mã Base64

    Chuyển văn bản UTF-8 sang Base64 hoặc giải mã Base64 chuẩn và an toàn cho URL. Tùy chỉnh ký tự đệm và độ dài dòng.

  • Mã hóa và giải mã thực thể HTML

    Chuyển văn bản và ký tự Unicode sang thực thể HTML; giải mã tham chiếu ký tự có tên hoặc dạng số.

  • So sánh văn bản

    So sánh hai văn bản theo dòng, từ hoặc ký tự. Đánh dấu phần thêm và xóa, có tính cả dấu cách và xuống dòng.

Tác vụ thường dùng và ví dụ

  • Giải mã Base64

    Khôi phục Base64 thành văn bản UTF-8 dễ đọc hoặc tải xuống các byte gốc.

Tất cả công cụ dành cho lập trình viên

Mã hóa và chuyển đổi tệp

Chuyển đổi giữa văn bản, byte, URL và ảnh nhúng mà vẫn giữ nguyên dữ liệu gốc.

Kiểm tra dữ liệu và văn bản

Đọc dữ liệu có cấu trúc, xem nội dung token và tìm điểm khác nhau giữa các văn bản.

Mã băm, mã định danh và lịch chạy

Kiểm tra tính toàn vẹn của tệp, tạo mã định danh và làm việc với thời gian, lịch chạy định kỳ.

Văn bản và tệp được xử lý trên thiết bị của bạn. Đừng để kết quả nhạy cảm trong bộ nhớ tạm dùng chung. Hãy dùng thiết bị đáng tin cậy khi xử lý khóa bí mật và token.