Expanda el texto en su secuencia de bytes UTF-8; vea el decimal / hex / binario de cada carácter
UTF-8 es una codificación Unicode de longitud variable: los caracteres ASCII (0-127) ocupan 1 byte; los caracteres no ASCII comunes ocupan 3 bytes; algunos caracteres raros y emojis ocupan 4 bytes. Es la codificación de caracteres más popular en internet, y la codificación subyacente que este sitio utiliza para todo el texto no ASCII.
Con esta herramienta puede ver directamente que "€" se codifica como tres bytes E2 82 AC (decimal 226, 130, 172), lo que explica por qué un mismo carácter no ASCII ocupa tamaños distintos según la codificación.
Entrada: € → Bytes: E2 82 AC (3 bytes)
Entrada: A → Bytes: 41 (1 byte, es decir ASCII 65)