UTF-8 编码 / 解码工具

文本与 UTF-8 编码互转,支持十六进制、\x 转义、URL 编码、十进制、Unicode 码点等多种格式,数据仅在本地运算

输入
输出(十六进制)
主输出格式
十六进制大小写
编码:文本 → UTF-8 字节序列;解码:字节序列 → 文本(自动识别格式)
快捷示例
UTF-8 编码说明
UTF-8(8-bit Unicode Transformation Format)是一种针对 Unicode 的可变长度字符编码,也是互联网上使用最广泛的 Unicode 实现方式。

编码规则:
Unicode 范围(十六进制)UTF-8 字节序列(二进制)字节数
U+0000 ~ U+007F0xxxxxxx1
U+0080 ~ U+07FF110xxxxx 10xxxxxx2
U+0800 ~ U+FFFF1110xxxx 10xxxxxx 10xxxxxx3
U+10000 ~ U+10FFFF11110xxx 10xxxxxx 10xxxxxx 10xxxxxx4

特点:
变长编码:ASCII 字符(如英文、数字)仅占 1 字节;中文常用字占 3 字节;Emoji 等占 4 字节
向后兼容 ASCII:所有 ASCII 字符(0-127)的 UTF-8 编码与 ASCII 完全一致
自同步:从任意字节开始最多 3 个字节内即可找到字符边界
无字节序问题:UTF-8 以字节为单位,无需 BOM(字节序标记)

常见用途:
• Web 页面编码(HTML、CSS、JavaScript 文件的默认编码)
• JSON 数据交换标准编码(RFC 8259)
• 数据库存储和 API 数据传输
• 操作系统和文件系统的默认编码
• 编程语言内部字符串表示(如 Go、Rust、Python 3 等)

本工具支持的输入格式(解码时自动识别):
E4 BD A0 E5 A5 BD — 十六进制(空格分隔)
E4BDA0E5A5BD — 十六进制(无空格)
\xE4\xBD\xA0\xE5\xA5\xBD — \x 转义格式
%E4%BD%A0%E5%A5%BD — URL 编码格式
228 189 160 229 165 189 — 十进制字节