Espandi il testo nella sua sequenza di byte UTF-8; vedi decimale / esadecimale / binario di ogni carattere
UTF-8 è una codifica Unicode a lunghezza variabile: i caratteri ASCII (0-127) occupano 1 byte; i caratteri non-ASCII comuni occupano 3 byte; alcuni caratteri rari ed emoji occupano 4 byte. È la codifica di caratteri più popolare su internet e la codifica sottostante che questo sito usa per tutto il testo non-ASCII.
Con questo strumento puoi vedere direttamente che "€" è codificato come tre byte E2 82 AC (decimale 226, 130, 172), il che spiega perché lo stesso carattere non-ASCII ha dimensioni diverse a seconda della codifica.
Input: € → Byte: E2 82 AC (3 byte)
Input: A → Byte: 41 (1 byte, ovvero ASCII 65)