TL
Tool Lab
💰Spenden
💰Spenden

Unicode-Konverter

Untersucht Unicode-Codepunkte, UTF-8-Bytefolgen und Zeichenkategorien für beliebigen Text.

Text → Unicode-Info
Codepoint-Suche

Über dieses Tool

Der Unicode-Konverter analysiert beliebigen Text und gibt den Unicode-Codepoint (U+XXXX), die UTF-8-Bytesequenz und die Zeichenkategorie fuer jedes Zeichen zurueck.

UTF-8 ist eine variable-Breite-Kodierung: ASCII (U+0000-U+007F) belegt 1 Byte, U+0080-U+07FF 2 Bytes, U+0800-U+FFFF (CJK, Arabisch, Hangul) 3 Bytes und U+10000+ (Emojis) 4 Bytes.

Anleitung

  1. Geben Sie Text in das Analysefeld ein und klicken Sie auf Analysieren.
  2. Die Tabelle zeigt fuer jedes Zeichen den Codepoint, UTF-8-Bytes und die Kategorie.
  3. Um ein bestimmtes Zeichen zu suchen, geben Sie seinen Codepoint (z.B. U+1F600) in das Suchfeld ein.
  4. Klicken Sie auf Suchen, um das Zeichen und seine Kodierungsdetails anzuzeigen.

Anwendungsfälle

Entwickler debuggen Zeichenkodierungsprobleme in Zeichenketten. Web-Entwickler verifizieren die korrekte Kodierung von Sonderzeichen. Sicherheitsforscher analysieren Unicode-Zeichen in Homographenangriffen.

Häufige Fragen

  • Was ist ein Unicode-Codepoint?Eine eindeutige Nummer, die jedem Zeichen im Unicode-Standard zugewiesen ist, geschrieben als U+XXXX in Hexadezimal (z.B. U+0041 = 'A').
  • Was ist UTF-8?Eine variable-Breite-Zeichenkodierung, die Unicode-Codepoints als 1-4 Bytes darstellt. Sie ist die dominante Kodierung im Web.
  • Warum belegen Emojis 4 Bytes in UTF-8?Emojis befinden sich in der Unicode Supplementary Multilingual Plane (U+10000+), die in UTF-8 4 Bytes benoetigt.