TL
Tool Lab
💰Donare
💰Donare

Convertitore Unicode

Ispeziona i code point Unicode, le sequenze di byte UTF-8 e le categorie di caratteri per qualsiasi testo.

Testo → Info Unicode
Ricerca punto di codice

Informazioni su questo strumento

Il convertitore Unicode analizza qualsiasi testo e restituisce il punto di codice Unicode (U+XXXX), la sequenza di byte UTF-8 e la categoria di ogni carattere.

UTF-8 e una codifica a larghezza variabile: ASCII (U+0000-U+007F) usa 1 byte, U+0080-U+07FF 2 byte, U+0800-U+FFFF (CJK, arabo, hangul) 3 byte e U+10000+ (emoji) 4 byte.

Come usare

  1. Digita o incolla testo nel campo di analisi e fai clic su Analizza.
  2. La tabella mostra il carattere, il punto di codice, i byte UTF-8 e la categoria per ogni carattere.
  3. Per cercare un carattere specifico, inserisci il suo punto di codice (es. U+1F600) nel campo di ricerca.
  4. Fai clic su Cerca per visualizzare il carattere e i dettagli di codifica.

Casi d'uso

Gli ingegneri eseguono il debug dei problemi di codifica dei caratteri. Gli sviluppatori web verificano che i caratteri speciali siano correttamente codificati. I ricercatori di sicurezza analizzano i caratteri Unicode usati negli attacchi omografi.

Domande frequenti

  • Cos'e un punto di codice Unicode?Un numero univoco assegnato a ogni carattere nello standard Unicode, scritto come U+XXXX in esadecimale (es. U+0041 = 'A').
  • Cos'e UTF-8?Una codifica di caratteri a larghezza variabile che rappresenta i punti di codice Unicode come 1-4 byte. E la codifica dominante sul web.
  • Perche le emoji occupano 4 byte in UTF-8?Le emoji si trovano nel Piano Multilingue Supplementare di Unicode (U+10000+), che richiede 4 byte in UTF-8.