UTF-8 转换器
将文本转换为 UTF-8 十六进制字节、十进制字节、\xAB 转义序列或 \u{HEX} 转义序列——反之亦然。
使用方法
- 1 选择 Text → Bytes(编码)或 Bytes → Text(解码)。
- 2 编码时选择输出格式——hex、decimal、\xAB 或 \u{HEX}。
- 3 粘贴输入内容。解码时,工具会自动识别你所使用的格式。
- 4 复制结果。
为什么使用此工具
- 四种输出格式——hex、decimal、C/Python 风格的 \x 转义序列、JS 风格的 \u{} 转义序列。
- 智能解码——自动识别输入是 hex、decimal、\x 还是 \u 格式。
- 对代理对(surrogate pair)安全——码点转义序列使用完整的 Unicode 码点,而非 UTF-16 编码单元。
- 全部处理均由纯浏览器逻辑完成,不依赖任何第三方库。
常见问题
\xAB 和 \u{HEX} 有什么区别?
\xAB 表示一个 UTF-8 字节——多字节字符会展开成多个转义序列。\u{HEX} 表示一个 Unicode 码点——无论 UTF-8 编码长度是多少,每个字符只需一个转义序列。JS 的模板字符串能够识别 \u{...} 语法。
为什么 emoji 会占用 4 个字节?
很多 emoji 的码点超过 U+FFFF,因此需要 4 个字节的 UTF-8 编码。使用码点转义格式(\u{1F680})可以将其显示为单个逻辑字符。
这个工具能解码混合格式吗?
不能——输入内容必须全部是 hex、全部是 decimal、全部是 \xAB,或全部是 \u{},这样才能确保格式识别不出错。请将混合的输入内容拆分开,分别处理。
只是想做 Base64 编码?
请使用我们的 Base64 编码/解码工具——输入文本或文件,即可获得 Base64 结果。
什么是 UTF-8 转换器?
UTF-8 转换器可以将文本转换为 UTF-8 字节表示形式,也可以反向将其解码还原为文本。该工具支持将字节以十六进制、十进制、\xAB 转义序列或 \u{HEX} 码点转义序列的形式输出,并能将这些格式解码还原为可读文本。整个转换过程完全在浏览器端(客户端)完成,输入的文本不会上传到服务器。
功能特性
多种字节格式
以十六进制、十进制、\xAB 或 \u{HEX} 转义形式输出 UTF-8。
双向转换
将文本编码为字节,并将字节/转义序列解码还原为文本。
100% 隐私保护
在客户端运行——你的文本永远不会离开浏览器。
示例
Input
café
Output
63 61 66 c3 a9
常见使用场景
-
1
调试多字节字符
查看“é”占用两个字节(C3 A9),以诊断编码和长度相关的错误。
-
2
生成转义字面量
为源代码或数据文件生成 \xAB 或 \u{HEX} 序列。
-
3
解码字节序列
将捕获的 UTF-8 字节列表转换回可读文本。
Zerethon 的 UTF-8 转换器可显示文本的精确 UTF-8 字节——以十六进制、十进制、\xAB 转义或 \u{HEX} 码点转义的形式——并将其解码还原为文本,全部在浏览器中完成。它揭示了多字节字符的编码方式(RFC 3629)。不会上传任何数据。
- 分类
- 开发者
- 价格
- 免费
- 隐私
- 基于浏览器
- 注册
- 无需
参考资料
- RFC 3629 — UTF-8, a transformation format of ISO 10646 — IETF
- The Unicode Standard — Unicode
- TextEncoder — MDN Web Docs — MDN
隐私
除非另有说明,否则你的数据永远不会离开浏览器。UTF-8 转换器 完全在客户端运行 — 无需上传服务器,不记录日志,不追踪你输入的内容。
对比
了解基础知识
操作指南
相关工具
在 Zerethon Social 上创作、分享与成长
免费注册。赚取积分,收集成就,与全球创作者建立联系。