Visualizzatore UTF-8

Espandi il testo nella sua sequenza di byte UTF-8; vedi decimale / esadecimale / binario di ogni carattere

Caratteri: {{ charCount }} Byte: {{ byteCount }}
#CarattereDecimaleHexBinario
{{ r.index }} {{ r.display }} {{ r.dec }} {{ r.hex }} {{ r.bin }}
Mostrati i primi {{ maxRows }} byte, {{ rows.length }} byte totali
Inserisci testo per vedere qui la sequenza di byte UTF-8
Strumento Hex →

Informazioni sulla codifica UTF-8

UTF-8 è una codifica Unicode a lunghezza variabile: i caratteri ASCII (0-127) occupano 1 byte; i caratteri non-ASCII comuni occupano 3 byte; alcuni caratteri rari ed emoji occupano 4 byte. È la codifica di caratteri più popolare su internet e la codifica sottostante che questo sito usa per tutto il testo non-ASCII.

Con questo strumento puoi vedere direttamente che "€" è codificato come tre byte E2 82 AC (decimale 226, 130, 172), il che spiega perché lo stesso carattere non-ASCII ha dimensioni diverse a seconda della codifica.

Esempi

Input: → Byte: E2 82 AC (3 byte)

Input: A → Byte: 41 (1 byte, ovvero ASCII 65)

FAQ

D: Perché un carattere non-ASCII mostra 3 byte?
R: In UTF-8, i caratteri nell'intervallo U+0800 e U+FFFF (che copre la maggior parte dei caratteri non-ASCII) usano una codifica fissa a 3 byte. È per la regola a lunghezza variabile di UTF-8, non un errore.
D: Come corrispondono esadecimale, decimale e binario?
R: Tutti e tre descrivono lo stesso valore di byte in basi diverse. Ad esempio il valore di byte 228 è E4 in esadecimale e 11100100 in binario. Questo strumento li elenca affiancati per un confronto facile.