Unicode Converter
Inspecteert Unicode-codepunten, UTF-8 bytesequenties en tekenklassen voor elke tekst.
Tekst → Unicode-info
Codepunt opzoeken
Over deze tool
De Unicode-converter analyseert willekeurige tekst en geeft het Unicode-codepunt (U+XXXX), de UTF-8-bytesequentie en de tekencategorie terug voor elk teken.
UTF-8 is een variabele-breedte-codering: ASCII (U+0000-U+007F) gebruikt 1 byte, U+0080-U+07FF 2 bytes, U+0800-U+FFFF (CJK, Arabisch, Hangul) 3 bytes en U+10000+ (emoji) 4 bytes.
Hoe te gebruiken
- Typ of plak tekst in het analyseveld en klik op Analyseren.
- De tabel toont het teken, codepunt, UTF-8-bytes en categorie voor elk teken.
- Om een specifiek teken op te zoeken, voer het codepunt (bijv. U+1F600) in het zoekveld in.
- Klik op Opzoeken om het teken en de coderingdetails te zien.
Gebruiksscenario's
Ontwikkelaars debuggen tekencoderingsfouten in strings. Webontwikkelaars controleren of speciale tekens correct gecodeerd zijn. Beveiligingsonderzoekers analyseren Unicode-tekens gebruikt in homograafafvallen.
Veelgestelde vragen
- Wat is een Unicode-codepunt? — Een uniek nummer toegewezen aan elk teken in de Unicode-standaard, geschreven als U+XXXX in hexadecimaal (bijv. U+0041 = 'A').
- Wat is UTF-8? — Een variabele-breedte-tekencodering die Unicode-codepunten weergeeft als 1-4 bytes. Het is de dominante codering op het web.
- Waarom nemen emoji 4 bytes in UTF-8? — Emoji bevinden zich in het Unicode Supplementary Multilingual Plane (U+10000+), waarvoor 4 bytes nodig zijn in UTF-8.