ตัวแปลง Unicode
ตรวจสอบจุดรหัส Unicode ลำดับไบต์ UTF-8 และหมวดหมู่อักขระสำหรับข้อความใดก็ได้
ข้อความ → ข้อมูล Unicode
ค้นหาจุดรหัส
เกี่ยวกับเครื่องมือนี้
ตัวแปลง Unicode วิเคราะห์ข้อความและคืนค่าจุดรหัส Unicode (U+XXXX) ลำดับไบต์ UTF-8 และหมวดหมู่ของแต่ละอักขระ
UTF-8 เป็นการเข้ารหัสความกว้างแปรผัน: ASCII (U+0000-U+007F) ใช้ 1 ไบต์ U+0080-U+07FF ใช้ 2 ไบต์ U+0800-U+FFFF ใช้ 3 ไบต์ และ U+10000+ (emoji) ใช้ 4 ไบต์
วิธีใช้งาน
- พิมพ์หรือวางข้อความในช่องวิเคราะห์ข้อความแล้วคลิกวิเคราะห์
- ตารางแสดงจุดรหัส ไบต์ UTF-8 และหมวดหมู่ของแต่ละอักขระ
- ในการค้นหาอักขระเฉพาะ ให้ป้อนจุดรหัส (เช่น U+1F600) ในช่องค้นหา
- คลิกค้นหาเพื่อดูอักขระและรายละเอียดการเข้ารหัส
กรณีการใช้งาน
นักพัฒนาซอฟต์แวร์ใช้เพื่อดีบักปัญหาการเข้ารหัสอักขระ นักพัฒนาเว็บตรวจสอบว่าอักขระพิเศษถูกเข้ารหัสอย่างถูกต้อง นักวิจัยด้านความปลอดภัยวิเคราะห์อักขระ Unicode ในการโจมตี homograph
คำถามที่พบบ่อย
- จุดรหัส Unicode คืออะไร? — หมายเลขเฉพาะที่กำหนดให้กับทุกอักขระในมาตรฐาน Unicode เขียนในรูปแบบ U+XXXX เลขฐานสิบหก (เช่น U+0041 = 'A')
- UTF-8 คืออะไร? — การเข้ารหัสอักขระความกว้างแปรผันที่แสดงจุดรหัส Unicode เป็น 1-4 ไบต์ เป็นการเข้ารหัสที่ใช้มากที่สุดบนเว็บ
- ทำไม emoji ถึงใช้ 4 ไบต์ใน UTF-8? — Emoji อยู่ใน Unicode Supplementary Multilingual Plane (U+10000+) ซึ่งต้องการ 4 ไบต์ใน UTF-8