TL
Tool Lab
💰Donate
💰Donate

Unicode-konverterare

Inspekterar Unicode-kodpunkter, UTF-8-bytesekvenser och teckenkategorier för valfri text.

Text -> Unicode-info
Sla upp kodpunkt

Om det här verktyget

Unicode-konverteraren analyserar vilken text som helst och returnerar Unicode-kodpunkten (U+XXXX), UTF-8-bytesekvensen och teckenkategorin for varje tecken.

UTF-8 ar en kodning med variabel bredd: ASCII (U+0000-U+007F) anvander 1 byte, U+0080-U+07FF 2 bytes, U+0800-U+FFFF (CJK, arabiska, hangul) 3 bytes och U+10000+ (emoji) 4 bytes.

Hur man använder

  1. Skriv eller klistra in text i analysfältet och klicka pa Analysera.
  2. Tabellen visar tecken, kodpunkt, UTF-8-bytes och kategori for varje tecken.
  3. For att sla upp ett specifikt tecken, ange dess kodpunkt (t.ex. U+1F600) i sökfältet.
  4. Klicka pa Sla upp for att se tecknet och kodningsdetaljer.

Användningsfall

Utvecklare felsöker teckenkodningsproblem i strängar. Webbutvecklare kontrollerar att specialtecken kodas korrekt. Säkerhetsforskare analyserar Unicode-tecken som används i homografangrepp.

Vanliga frågor

  • Vad är en Unicode-kodpunkt?Ett unikt nummer tilldelat varje tecken i Unicode-standarden, skrivet som U+XXXX i hexadecimalt (t.ex. U+0041 = 'A').
  • Vad är UTF-8?En teckenkodning med variabel bredd som representerar Unicode-kodpunkter som 1-4 bytes. Det är den dominerande kodningen på webben.
  • Varför tar emoji 4 bytes i UTF-8?Emoji finns i Unicodes Supplementary Multilingual Plane (U+10000+) som kräver 4 bytes i UTF-8-kodning.