Visualizador UTF-8

Expanda o texto em sua sequência de bytes UTF-8; veja decimal / hex / binário de cada caractere

Caracteres: {{ charCount }} Bytes: {{ byteCount }}
#CharDecimalHexBinário
{{ r.index }} {{ r.display }} {{ r.dec }} {{ r.hex }} {{ r.bin }}
Exibindo os primeiros {{ maxRows }} bytes, {{ rows.length }} bytes no total
Digite o texto para ver a sequência de bytes UTF-8 aqui
Ferramenta Hex →

Sobre a Codificação UTF-8

O UTF-8 é uma codificação Unicode de comprimento variável: caracteres ASCII (0-127) ocupam 1 byte; caracteres não-ASCII comuns ocupam 3 bytes; alguns caracteres raros e emoji ocupam 4 bytes. É a codificação de caracteres mais popular na internet e a codificação subjacente que este site usa para todo o texto.

Com esta ferramenta você pode ver diretamente que "€" é codificado como três bytes E2 82 AC (decimal 226, 130, 172), o que explica por que o mesmo caractere não-ASCII ocupa tamanhos diferentes em codificações diferentes.

Exemplos

Entrada: → Bytes: E2 82 AC (3 bytes)

Entrada: A → Bytes: 41 (1 byte, ou seja, ASCII 65)

Perguntas Frequentes

P: Por que um caractere não-ASCII aparece com 3 bytes?
R: No UTF-8, caracteres na faixa U+0800 a U+FFFF (que cobre a maioria dos caracteres não-ASCII) usam uma codificação fixa de 3 bytes. Isso ocorre pela regra de comprimento variável do UTF-8, não é um erro.
P: Como hex, decimal e binário se correspondem?
R: Os três descrevem o mesmo valor de byte em bases diferentes. Por exemplo, o valor de byte 228 é E4 em hex e 11100100 em binário. Esta ferramenta os lista lado a lado para fácil comparação.
Espaço de Anúncio AdSense (728x90 responsivo)