Unicode转换器
检查任何文本的Unicode代码点、UTF-8字节序列和字符类别。
文本 → Unicode 信息
码位查询
关于本工具
Unicode 转换器分析任意文本,返回每个字符的 Unicode 码位(U+XXXX)、UTF-8 字节序列和字符类别。
UTF-8 是可变宽度编码:ASCII(U+0000-U+007F)占 1 字节,U+0080-U+07FF 占 2 字节,U+0800-U+FFFF(CJK、阿拉伯语、韩文)占 3 字节,U+10000+(大多数表情符号)占 4 字节。
使用方法
- 在文本分析字段中输入或粘贴文本,然后点击分析。
- 表格显示每个字符的码位、UTF-8 字节和类别。
- 要查询特定字符,在码位查询字段中输入码位(如 U+1F600)。
- 点击查询按钮查看该字符及其编码详情。
使用场景
工程师调试包含意外符号的字符串中的编码问题。Web 开发者验证特殊字符在存储前是否正确编码。安全研究人员分析同形字攻击中使用的 Unicode 字符。
常见问题
- 什么是 Unicode 码位? — 分配给 Unicode 标准中每个字符的唯一编号,以十六进制 U+XXXX 格式表示(如 U+0041 = 'A')。
- 什么是 UTF-8? — 将 Unicode 码位表示为 1-4 字节的可变宽度字符编码,是网络上最主流的编码方式。
- 为什么表情符号在 UTF-8 中占 4 字节? — 表情符号位于 Unicode 辅助多语言平面(U+10000+),在 UTF-8 编码中需要 4 字节。