Unicode-Konverter
Untersucht Unicode-Codepunkte, UTF-8-Bytefolgen und Zeichenkategorien für beliebigen Text.
Text → Unicode-Info
Codepoint-Suche
Über dieses Tool
Der Unicode-Konverter analysiert beliebigen Text und gibt den Unicode-Codepoint (U+XXXX), die UTF-8-Bytesequenz und die Zeichenkategorie fuer jedes Zeichen zurueck.
UTF-8 ist eine variable-Breite-Kodierung: ASCII (U+0000-U+007F) belegt 1 Byte, U+0080-U+07FF 2 Bytes, U+0800-U+FFFF (CJK, Arabisch, Hangul) 3 Bytes und U+10000+ (Emojis) 4 Bytes.
Anleitung
- Geben Sie Text in das Analysefeld ein und klicken Sie auf Analysieren.
- Die Tabelle zeigt fuer jedes Zeichen den Codepoint, UTF-8-Bytes und die Kategorie.
- Um ein bestimmtes Zeichen zu suchen, geben Sie seinen Codepoint (z.B. U+1F600) in das Suchfeld ein.
- Klicken Sie auf Suchen, um das Zeichen und seine Kodierungsdetails anzuzeigen.
Anwendungsfälle
Entwickler debuggen Zeichenkodierungsprobleme in Zeichenketten. Web-Entwickler verifizieren die korrekte Kodierung von Sonderzeichen. Sicherheitsforscher analysieren Unicode-Zeichen in Homographenangriffen.
Häufige Fragen
- Was ist ein Unicode-Codepoint? — Eine eindeutige Nummer, die jedem Zeichen im Unicode-Standard zugewiesen ist, geschrieben als U+XXXX in Hexadezimal (z.B. U+0041 = 'A').
- Was ist UTF-8? — Eine variable-Breite-Zeichenkodierung, die Unicode-Codepoints als 1-4 Bytes darstellt. Sie ist die dominante Kodierung im Web.
- Warum belegen Emojis 4 Bytes in UTF-8? — Emojis befinden sich in der Unicode Supplementary Multilingual Plane (U+10000+), die in UTF-8 4 Bytes benoetigt.