TL
Tool Lab
💰Donate
💰Donate

Conversor Unicode

Inspeciona code points Unicode, sequências de bytes UTF-8 e categorias de caracteres para qualquer texto.

Texto → Info Unicode
Busca por ponto de codigo

Sobre esta ferramenta

O Conversor Unicode analisa qualquer texto e retorna o ponto de codigo Unicode (U+XXXX), a sequencia de bytes UTF-8 e a categoria de cada caractere.

UTF-8 e uma codificacao de largura variavel: ASCII (U+0000-U+007F) usa 1 byte, U+0080-U+07FF usa 2 bytes, U+0800-U+FFFF usa 3 bytes e U+10000+ (emojis) usa 4 bytes.

Como usar

  1. Digite ou cole texto no campo de analise de texto e clique em Analisar.
  2. A tabela mostra o caractere, ponto de codigo, bytes UTF-8 e categoria de cada caractere.
  3. Para pesquisar um caractere especifico, insira seu ponto de codigo (ex.: U+1F600) no campo de busca.
  4. Clique em Buscar para ver o caractere e seus detalhes de codificacao.

Casos de uso

Engenheiros depuram problemas de codificacao de caracteres em strings. Desenvolvedores web verificam se caracteres especiais sao codificados corretamente. Pesquisadores de seguranca analisam caracteres Unicode usados em ataques de homografos.

Perguntas frequentes

  • O que e um ponto de codigo Unicode?Um numero unico atribuido a cada caractere no padrao Unicode, escrito como U+XXXX em hexadecimal (ex.: U+0041 = 'A').
  • O que e UTF-8?Uma codificacao de caracteres de largura variavel que representa pontos de codigo Unicode como 1-4 bytes. E a codificacao dominante na web.
  • Por que emojis ocupam 4 bytes em UTF-8?Emojis estao no Plano Multilingue Suplementar do Unicode (U+10000+), que requer 4 bytes em UTF-8.