TL
Tool Lab
💰Donate
💰Donate

Konverter Unicode

Memeriksa code point Unicode, urutan byte UTF-8, dan kategori karakter untuk teks apapun.

Teks → Info Unicode
Cari titik kode

Tentang alat ini

Unicode Converter menganalisis teks apa pun dan mengembalikan titik kode Unicode (U+XXXX), urutan byte UTF-8, dan kategori karakter untuk setiap karakter.

UTF-8 adalah pengkodean lebar variabel: ASCII (U+0000-U+007F) menggunakan 1 byte, U+0080-U+07FF 2 byte, U+0800-U+FFFF (CJK, Arab, Hangul) 3 byte, dan U+10000+ (emoji) 4 byte.

Cara penggunaan

  1. Ketik atau tempel teks ke kolom analisis dan klik Analisis.
  2. Tabel menampilkan karakter, titik kode, byte UTF-8, dan kategori untuk setiap karakter.
  3. Untuk mencari karakter tertentu, masukkan titik kodenya (mis. U+1F600) di kolom pencarian.
  4. Klik Cari untuk melihat karakter dan detail pengkodeannya.

Kasus penggunaan

Engineer men-debug masalah pengkodean karakter dalam string. Pengembang web memverifikasi karakter khusus dikodekan dengan benar. Peneliti keamanan menganalisis karakter Unicode yang digunakan dalam serangan homograf.

Pertanyaan umum

  • Apa itu titik kode Unicode?Nomor unik yang ditetapkan untuk setiap karakter dalam standar Unicode, ditulis sebagai U+XXXX dalam heksadesimal (mis. U+0041 = 'A').
  • Apa itu UTF-8?Pengkodean karakter lebar variabel yang mewakili titik kode Unicode sebagai 1-4 byte. Ini adalah pengkodean dominan di web.
  • Mengapa emoji menggunakan 4 byte dalam UTF-8?Emoji berada di Unicode Supplementary Multilingual Plane (U+10000+) yang memerlukan 4 byte dalam pengkodean UTF-8.