Konverter Unicode
Memeriksa code point Unicode, urutan byte UTF-8, dan kategori karakter untuk teks apapun.
Teks → Info Unicode
Cari titik kode
Tentang alat ini
Unicode Converter menganalisis teks apa pun dan mengembalikan titik kode Unicode (U+XXXX), urutan byte UTF-8, dan kategori karakter untuk setiap karakter.
UTF-8 adalah pengkodean lebar variabel: ASCII (U+0000-U+007F) menggunakan 1 byte, U+0080-U+07FF 2 byte, U+0800-U+FFFF (CJK, Arab, Hangul) 3 byte, dan U+10000+ (emoji) 4 byte.
Cara penggunaan
- Ketik atau tempel teks ke kolom analisis dan klik Analisis.
- Tabel menampilkan karakter, titik kode, byte UTF-8, dan kategori untuk setiap karakter.
- Untuk mencari karakter tertentu, masukkan titik kodenya (mis. U+1F600) di kolom pencarian.
- Klik Cari untuk melihat karakter dan detail pengkodeannya.
Kasus penggunaan
Engineer men-debug masalah pengkodean karakter dalam string. Pengembang web memverifikasi karakter khusus dikodekan dengan benar. Peneliti keamanan menganalisis karakter Unicode yang digunakan dalam serangan homograf.
Pertanyaan umum
- Apa itu titik kode Unicode? — Nomor unik yang ditetapkan untuk setiap karakter dalam standar Unicode, ditulis sebagai U+XXXX dalam heksadesimal (mis. U+0041 = 'A').
- Apa itu UTF-8? — Pengkodean karakter lebar variabel yang mewakili titik kode Unicode sebagai 1-4 byte. Ini adalah pengkodean dominan di web.
- Mengapa emoji menggunakan 4 byte dalam UTF-8? — Emoji berada di Unicode Supplementary Multilingual Plane (U+10000+) yang memerlukan 4 byte dalam pengkodean UTF-8.