Décomposez le texte en sa séquence d'octets UTF-8 ; voyez le décimal / hexa / binaire de chaque caractère
UTF-8 est un encodage Unicode à longueur variable : les caractères ASCII (0-127) occupent 1 octet ; les caractères non-ASCII courants occupent 3 octets ; certains caractères rares et émojis occupent 4 octets. C'est l'encodage de caractères le plus populaire sur Internet, et l'encodage sous-jacent utilisé par ce site pour tout le texte.
Avec cet outil, vous pouvez voir directement que « € » est encodé en trois octets E2 82 AC (décimal 226, 130, 172), ce qui explique pourquoi le même caractère non-ASCII occupe des tailles différentes selon les encodages.
Entrée : € → Octets : E2 82 AC (3 octets)
Entrée : A → Octets : 41 (1 octet, soit ASCII 65)