左右任意一边输入,另一边实时更新。仅处理 UTF-8 编码(GBK 等请用专门工具)。全部在浏览器本地转换,不上传。
| 字符 | Unicode | UTF-8 字节 | UTF-16 (BE) |
|---|
文本和 UTF-8 十六进制字节互转,左右两边任意一边改,另一边实时更新。
0x、\x、% 前缀的十六进制;位数为奇数会明确报错,不会悄悄截断。\x 前缀(C、Java 风格)/ % 前缀(URL 编码)/ 0x, 逗号(数组初始化风格),大小写可切。只处理 UTF-8。GBK / GB2312 / Big5 请用专门的编码转换工具。全部在浏览器本地完成,不上传。
| 文本 | UTF-8 Hex | 字节数 | 说明 |
|---|---|---|---|
A |
41 |
1 | ASCII,和码点一样 |
你 |
E4 BD A0 |
3 | 基本汉字(U+4F60) |
€ |
E2 82 AC |
3 | 欧元符号(U+20AC) |
😊 |
F0 9F 98 8A |
4 | Emoji(U+1F60A,用了代理对) |
Q:为什么一个汉字是 3 个字节? A:UTF-8 是变长编码。U+0000–007F 用 1 字节、U+0080–07FF 用 2 字节、U+0800–FFFF(含绝大多数汉字)用 3 字节、U+10000 以上(Emoji、生僻字)用 4 字节。
Q:出现 � 是怎么回事?
A:那是替换字符(U+FFFD)。说明这段十六进制不是合法的 UTF-8 字节序列——可能少了字节、字节顺序错了,或者本来就是别的编码(如 GBK)。
Q:粘进来的是 \xE4\xBD\xA0 也能认吗?
A:能。0x、\x、%、空格、逗号都会被清理掉,只留十六进制数字再两两配对。
Q:"锟斤拷" 能查出原因吗? A:把乱码文本转成 Hex,对照 UTF-8 规则看字节,通常是 UTF-8 被按 GBK 解码、或反过来。这个工具能帮你看清字节,但不做 GBK 转换。
Q:数据会上传吗? A:不会,纯本地转换。
相关:Escape 编解码 · ASCII 对照表 · Unicode 查询 · Base64 编解码 · 字节转换。