UTF-8 编码查看

将文本展开为 UTF-8 字节序列,查看每个字符的十进制 / 十六进制 / 二进制表示

字符: {{ charCount }} 字节: {{ byteCount }}
#字符十进制十六进制二进制
{{ r.index }} {{ r.display }} {{ r.dec }} {{ r.hex }} {{ r.bin }}
仅显示前 {{ maxRows }} 字节,共 {{ rows.length }} 字节
输入文本后将在此显示 UTF-8 字节序列
Hex 编解码 →

关于 UTF-8 编码

UTF-8 是一种可变长度的 Unicode 编码:ASCII 字符(0-127)占 1 字节;常用汉字占 3 字节;部分生僻字符和 emoji 占 4 字节。它是互联网上最主流的字符编码,也是本网站所有工具处理中文的底层编码方式。

通过本工具,你可以直观地看到「你」被编码为三个字节 E4 BD A0(十进制 228、189、160),从而理解为什么同一个汉字在不同编码下占用不同大小。

使用示例

输入: → 字节:E4 BD A0(3 字节)

输入:A → 字节:41(1 字节,即 ASCII 65)

常见问题

Q: 为什么一个汉字显示 3 个字节?
A: UTF-8 中 U+0800 到 U+FFFF 范围的字符(包含绝大多数汉字)固定使用 3 字节编码,这是 UTF-8 变长规则决定的,并非异常。
Q: 十六进制和十进制、二进制怎么对应?
A: 三者描述的是同一个字节值的不同进制表示。例如字节值 228,十六进制为 E4,二进制为 11100100。本工具同时列出,方便对照学习。