Konwerter Unicode
Sprawdza punkty kodowe Unicode, sekwencje bajtów UTF-8 i kategorie znaków dla dowolnego tekstu.
Tekst -> Informacje Unicode
Wyszukiwanie punktu kodowego
O tym narzędziu
Konwerter Unicode analizuje dowolny tekst i zwraca punkt kodowy Unicode (U+XXXX), sekwencje bajtow UTF-8 oraz kategorie dla kazdego znaku.
UTF-8 to kodowanie o zmiennej szerokosci: ASCII (U+0000-U+007F) uzywaja 1 bajtu, U+0080-U+07FF 2 bajtow, U+0800-U+FFFF (CJK, arabski, hangul) 3 bajtow, a U+10000+ (emoji) 4 bajtow.
Jak używać
- Wpisz lub wklej tekst w polu analizy i kliknij Analizuj.
- Tabela pokazuje znak, punkt kodowy, bajty UTF-8 i kategorie dla kazdego znaku.
- Aby wyszukac konkretny znak, wpisz jego punkt kodowy (np. U+1F600) w polu wyszukiwania.
- Kliknij Szukaj, aby zobaczyc znak i szczegoly kodowania.
Przypadki użycia
Inzynierowie debuguja problemy z kodowaniem znakow w lancuchach. Programisci webowi weryfikuja poprawne kodowanie znakow specjalnych. Badacze bezpieczenstwa analizuja znaki Unicode uzywane w atakach homograficznych.
Często zadawane pytania
- Co to jest punkt kodowy Unicode? — Unikalny numer przypisany do kazdego znaku w standardzie Unicode, zapisywany jako U+XXXX szesnastkowo (np. U+0041 = 'A').
- Co to jest UTF-8? — Kodowanie znakow o zmiennej szerokosci, ktore reprezentuje punkty kodowe Unicode jako 1-4 bajty. Jest dominujacym kodowaniem w sieci.
- Dlaczego emoji zajmuja 4 bajty w UTF-8? — Emoji naleza do Suplementarnej Plaszczyzny Wielojezycznej Unicode (U+10000+), ktora wymaga 4 bajtow w kodowaniu UTF-8.