TL
Tool Lab
💰Donate
💰Donate

Konwerter Unicode

Sprawdza punkty kodowe Unicode, sekwencje bajtów UTF-8 i kategorie znaków dla dowolnego tekstu.

Tekst -> Informacje Unicode
Wyszukiwanie punktu kodowego

O tym narzędziu

Konwerter Unicode analizuje dowolny tekst i zwraca punkt kodowy Unicode (U+XXXX), sekwencje bajtow UTF-8 oraz kategorie dla kazdego znaku.

UTF-8 to kodowanie o zmiennej szerokosci: ASCII (U+0000-U+007F) uzywaja 1 bajtu, U+0080-U+07FF 2 bajtow, U+0800-U+FFFF (CJK, arabski, hangul) 3 bajtow, a U+10000+ (emoji) 4 bajtow.

Jak używać

  1. Wpisz lub wklej tekst w polu analizy i kliknij Analizuj.
  2. Tabela pokazuje znak, punkt kodowy, bajty UTF-8 i kategorie dla kazdego znaku.
  3. Aby wyszukac konkretny znak, wpisz jego punkt kodowy (np. U+1F600) w polu wyszukiwania.
  4. Kliknij Szukaj, aby zobaczyc znak i szczegoly kodowania.

Przypadki użycia

Inzynierowie debuguja problemy z kodowaniem znakow w lancuchach. Programisci webowi weryfikuja poprawne kodowanie znakow specjalnych. Badacze bezpieczenstwa analizuja znaki Unicode uzywane w atakach homograficznych.

Często zadawane pytania

  • Co to jest punkt kodowy Unicode?Unikalny numer przypisany do kazdego znaku w standardzie Unicode, zapisywany jako U+XXXX szesnastkowo (np. U+0041 = 'A').
  • Co to jest UTF-8?Kodowanie znakow o zmiennej szerokosci, ktore reprezentuje punkty kodowe Unicode jako 1-4 bajty. Jest dominujacym kodowaniem w sieci.
  • Dlaczego emoji zajmuja 4 bajty w UTF-8?Emoji naleza do Suplementarnej Plaszczyzny Wielojezycznej Unicode (U+10000+), ktora wymaga 4 bajtow w kodowaniu UTF-8.