Convertitore Unicode
Ispeziona i code point Unicode, le sequenze di byte UTF-8 e le categorie di caratteri per qualsiasi testo.
Testo → Info Unicode
Ricerca punto di codice
Informazioni su questo strumento
Il convertitore Unicode analizza qualsiasi testo e restituisce il punto di codice Unicode (U+XXXX), la sequenza di byte UTF-8 e la categoria di ogni carattere.
UTF-8 e una codifica a larghezza variabile: ASCII (U+0000-U+007F) usa 1 byte, U+0080-U+07FF 2 byte, U+0800-U+FFFF (CJK, arabo, hangul) 3 byte e U+10000+ (emoji) 4 byte.
Come usare
- Digita o incolla testo nel campo di analisi e fai clic su Analizza.
- La tabella mostra il carattere, il punto di codice, i byte UTF-8 e la categoria per ogni carattere.
- Per cercare un carattere specifico, inserisci il suo punto di codice (es. U+1F600) nel campo di ricerca.
- Fai clic su Cerca per visualizzare il carattere e i dettagli di codifica.
Casi d'uso
Gli ingegneri eseguono il debug dei problemi di codifica dei caratteri. Gli sviluppatori web verificano che i caratteri speciali siano correttamente codificati. I ricercatori di sicurezza analizzano i caratteri Unicode usati negli attacchi omografi.
Domande frequenti
- Cos'e un punto di codice Unicode? — Un numero univoco assegnato a ogni carattere nello standard Unicode, scritto come U+XXXX in esadecimale (es. U+0041 = 'A').
- Cos'e UTF-8? — Una codifica di caratteri a larghezza variabile che rappresenta i punti di codice Unicode come 1-4 byte. E la codifica dominante sul web.
- Perche le emoji occupano 4 byte in UTF-8? — Le emoji si trovano nel Piano Multilingue Supplementare di Unicode (U+10000+), che richiede 4 byte in UTF-8.