TL
Tool Lab
💰Donate
💰Donate

ตัวแปลง Unicode

ตรวจสอบจุดรหัส Unicode ลำดับไบต์ UTF-8 และหมวดหมู่อักขระสำหรับข้อความใดก็ได้

ข้อความ → ข้อมูล Unicode
ค้นหาจุดรหัส

เกี่ยวกับเครื่องมือนี้

ตัวแปลง Unicode วิเคราะห์ข้อความและคืนค่าจุดรหัส Unicode (U+XXXX) ลำดับไบต์ UTF-8 และหมวดหมู่ของแต่ละอักขระ

UTF-8 เป็นการเข้ารหัสความกว้างแปรผัน: ASCII (U+0000-U+007F) ใช้ 1 ไบต์ U+0080-U+07FF ใช้ 2 ไบต์ U+0800-U+FFFF ใช้ 3 ไบต์ และ U+10000+ (emoji) ใช้ 4 ไบต์

วิธีใช้งาน

  1. พิมพ์หรือวางข้อความในช่องวิเคราะห์ข้อความแล้วคลิกวิเคราะห์
  2. ตารางแสดงจุดรหัส ไบต์ UTF-8 และหมวดหมู่ของแต่ละอักขระ
  3. ในการค้นหาอักขระเฉพาะ ให้ป้อนจุดรหัส (เช่น U+1F600) ในช่องค้นหา
  4. คลิกค้นหาเพื่อดูอักขระและรายละเอียดการเข้ารหัส

กรณีการใช้งาน

นักพัฒนาซอฟต์แวร์ใช้เพื่อดีบักปัญหาการเข้ารหัสอักขระ นักพัฒนาเว็บตรวจสอบว่าอักขระพิเศษถูกเข้ารหัสอย่างถูกต้อง นักวิจัยด้านความปลอดภัยวิเคราะห์อักขระ Unicode ในการโจมตี homograph

คำถามที่พบบ่อย

  • จุดรหัส Unicode คืออะไร?หมายเลขเฉพาะที่กำหนดให้กับทุกอักขระในมาตรฐาน Unicode เขียนในรูปแบบ U+XXXX เลขฐานสิบหก (เช่น U+0041 = 'A')
  • UTF-8 คืออะไร?การเข้ารหัสอักขระความกว้างแปรผันที่แสดงจุดรหัส Unicode เป็น 1-4 ไบต์ เป็นการเข้ารหัสที่ใช้มากที่สุดบนเว็บ
  • ทำไม emoji ถึงใช้ 4 ไบต์ใน UTF-8?Emoji อยู่ใน Unicode Supplementary Multilingual Plane (U+10000+) ซึ่งต้องการ 4 ไบต์ใน UTF-8