Visor UTF-8

Expanda el texto en su secuencia de bytes UTF-8; vea el decimal / hex / binario de cada carácter

Caracteres: {{ charCount }} Bytes: {{ byteCount }}
#CarácterDecimalHexBinario
{{ r.index }} {{ r.display }} {{ r.dec }} {{ r.hex }} {{ r.bin }}
Mostrando los primeros {{ maxRows }} bytes, {{ rows.length }} bytes en total
Ingrese texto para ver aquí la secuencia de bytes UTF-8
Herramienta Hex →

Acerca de la codificación UTF-8

UTF-8 es una codificación Unicode de longitud variable: los caracteres ASCII (0-127) ocupan 1 byte; los caracteres no ASCII comunes ocupan 3 bytes; algunos caracteres raros y emojis ocupan 4 bytes. Es la codificación de caracteres más popular en internet, y la codificación subyacente que este sitio utiliza para todo el texto no ASCII.

Con esta herramienta puede ver directamente que "€" se codifica como tres bytes E2 82 AC (decimal 226, 130, 172), lo que explica por qué un mismo carácter no ASCII ocupa tamaños distintos según la codificación.

Ejemplos

Entrada: → Bytes: E2 82 AC (3 bytes)

Entrada: A → Bytes: 41 (1 byte, es decir ASCII 65)

Preguntas frecuentes

P: ¿Por qué un carácter no ASCII muestra 3 bytes?
R: En UTF-8, los caracteres en el rango U+0800 a U+FFFF (que cubre la mayoría de los caracteres no ASCII) usan una codificación fija de 3 bytes. Esto obedece a la regla de longitud variable de UTF-8, no es un error.
P: ¿Cómo se corresponden hex, decimal y binario?
R: Los tres describen el mismo valor de byte en distintas bases. Por ejemplo, el byte 228 es E4 en hex y 11100100 en binario. Esta herramienta los lista uno al lado del otro para facilitar la comparación.