Visualiseur UTF-8

Décomposez le texte en sa séquence d'octets UTF-8 ; voyez le décimal / hexa / binaire de chaque caractère

Caractères : {{ charCount }} Octets : {{ byteCount }}
#Car.DécimalHexaBinaire
{{ r.index }} {{ r.display }} {{ r.dec }} {{ r.hex }} {{ r.bin }}
Affichage des {{ maxRows }} premiers octets, {{ rows.length }} octets au total
Saisissez du texte pour voir la séquence d'octets UTF-8 ici
Outil Hex →

À propos de l'encodage UTF-8

UTF-8 est un encodage Unicode à longueur variable : les caractères ASCII (0-127) occupent 1 octet ; les caractères non-ASCII courants occupent 3 octets ; certains caractères rares et émojis occupent 4 octets. C'est l'encodage de caractères le plus populaire sur Internet, et l'encodage sous-jacent utilisé par ce site pour tout le texte.

Avec cet outil, vous pouvez voir directement que « € » est encodé en trois octets E2 82 AC (décimal 226, 130, 172), ce qui explique pourquoi le même caractère non-ASCII occupe des tailles différentes selon les encodages.

Exemples

Entrée : → Octets : E2 82 AC (3 octets)

Entrée : A → Octets : 41 (1 octet, soit ASCII 65)

FAQ

Q : Pourquoi un caractère non-ASCII affiche-t-il 3 octets ?
R : En UTF-8, les caractères de la plage U+0800 à U+FFFF (couvrant la plupart des caractères non-ASCII) utilisent un encodage fixe de 3 octets. C'est dû à la règle de longueur variable UTF-8, pas une erreur.
Q : Comment hexadécimal, décimal et binaire correspondent-ils ?
R : Les trois décrivent la même valeur d'octet dans des bases différentes. Par exemple, la valeur d'octet 228 est E4 en hexadécimal et 11100100 en binaire. Cet outil les liste côte à côte pour faciliter la comparaison.