TL
Tool Lab
💰Faire un don
💰Faire un don

Convertisseur Unicode

Inspecte les points de code Unicode, les séquences d'octets UTF-8 et les catégories de caractères.

Texte → Info Unicode
Recherche de point de code

À propos de cet outil

Le convertisseur Unicode analyse n'importe quel texte et renvoie le point de code Unicode (U+XXXX), la sequence d'octets UTF-8 et la categorie de chaque caractere.

UTF-8 est un encodage a largeur variable : l'ASCII (U+0000-U+007F) utilise 1 octet, U+0080-U+07FF 2 octets, U+0800-U+FFFF (CJK, arabe, hangul) 3 octets et U+10000+ (emojis) 4 octets.

Comment utiliser

  1. Saisissez ou collez du texte dans le champ d'analyse et cliquez sur Analyser.
  2. Le tableau affiche le caractere, le point de code, les octets UTF-8 et la categorie de chaque caractere.
  3. Pour rechercher un caractere specifique, entrez son point de code (ex. U+1F600) dans le champ de recherche.
  4. Cliquez sur Rechercher pour voir le caractere et ses details d'encodage.

Cas d'utilisation

Les developpeurs deboguent les problemes d'encodage de caracteres. Les developpeurs web verifient que les caracteres speciaux sont correctement encodes. Les chercheurs en securite analysent les caracteres Unicode utilises dans les attaques homographes.

Questions fréquentes

  • Qu'est-ce qu'un point de code Unicode ?Un numero unique attribue a chaque caractere dans la norme Unicode, ecrit sous la forme U+XXXX en hexadecimal (ex. U+0041 = 'A').
  • Qu'est-ce que UTF-8 ?Un encodage de caracteres a largeur variable qui represente les points de code Unicode sur 1 a 4 octets. C'est l'encodage dominant sur le web.
  • Pourquoi les emojis occupent-ils 4 octets en UTF-8 ?Les emojis se trouvent dans le Plan Supplementaire Multilingue d'Unicode (U+10000+), qui requiert 4 octets en UTF-8.