TL
Tool Lab
💰Donate
💰Donate

Unicode Converter

Inspecteert Unicode-codepunten, UTF-8 bytesequenties en tekenklassen voor elke tekst.

Tekst → Unicode-info
Codepunt opzoeken

Over deze tool

De Unicode-converter analyseert willekeurige tekst en geeft het Unicode-codepunt (U+XXXX), de UTF-8-bytesequentie en de tekencategorie terug voor elk teken.

UTF-8 is een variabele-breedte-codering: ASCII (U+0000-U+007F) gebruikt 1 byte, U+0080-U+07FF 2 bytes, U+0800-U+FFFF (CJK, Arabisch, Hangul) 3 bytes en U+10000+ (emoji) 4 bytes.

Hoe te gebruiken

  1. Typ of plak tekst in het analyseveld en klik op Analyseren.
  2. De tabel toont het teken, codepunt, UTF-8-bytes en categorie voor elk teken.
  3. Om een specifiek teken op te zoeken, voer het codepunt (bijv. U+1F600) in het zoekveld in.
  4. Klik op Opzoeken om het teken en de coderingdetails te zien.

Gebruiksscenario's

Ontwikkelaars debuggen tekencoderingsfouten in strings. Webontwikkelaars controleren of speciale tekens correct gecodeerd zijn. Beveiligingsonderzoekers analyseren Unicode-tekens gebruikt in homograafafvallen.

Veelgestelde vragen

  • Wat is een Unicode-codepunt?Een uniek nummer toegewezen aan elk teken in de Unicode-standaard, geschreven als U+XXXX in hexadecimaal (bijv. U+0041 = 'A').
  • Wat is UTF-8?Een variabele-breedte-tekencodering die Unicode-codepunten weergeeft als 1-4 bytes. Het is de dominante codering op het web.
  • Waarom nemen emoji 4 bytes in UTF-8?Emoji bevinden zich in het Unicode Supplementary Multilingual Plane (U+10000+), waarvoor 4 bytes nodig zijn in UTF-8.