运行工具
本工具用于深入检查文本字符串中的每一个字符。当您输入文本后,系统会逐个处理每个字符,并提供其位置索引、字符本身、数值代码点、大写十六进制表示法以及 UTF-8 编码的十六进制字节序列。此外,工具还会根据代码点范围提供宽泛的分类标签。这对于开发者调试编码问题、验证特殊符号或了解多语言文本的底层结构非常有用。支持普通 ASCII 文本、中文汉字、表情符号等多种字符类型。如果输入为空,结果将显示零个字符和零个 UTF-8 字节。请注意,此工具基于迭代字符串字符进行处理,而非视觉上的字形簇或标准化后的文本。结果面板会清晰列出所有检测到的字符详情,帮助您准确理解数据的存储和传输形式。
使用说明
- 在“文本”输入框中粘贴或输入需要分析的字符串。
- 点击“运行”按钮开始处理。
- 查看结果面板中列出的每个字符的详细信息。
- 检查代码点、UTF-8 字节和分类标签以确认字符属性。
示例
- 输入英文单词 "Hi",结果显示两个字符的代码点分别为 U+0048 和 U+0069,UTF-8 字节分别为 48 和 69。
- 输入中文汉字 "好",结果显示其代码点为 U+597D,UTF-8 字节为 E5 A5 BD,分类标签为 CJK 统一表意文字范围。
常见问题
为什么有些字符的 UTF-8 字节长度不同?
UTF-8 是一种变长编码。ASCII 字符占用 1 个字节,而大多数中文汉字占用 3 个字节,部分表情符号可能占用 4 个字节。工具会准确显示每个字符实际占用的字节数。
如果我不输入任何文本会发生什么?
如果输入框为空,运行后结果面板会显示字符数为零,UTF-8 字节总数也为零。不会报错。
这里的分类标签是标准的 Unicode 属性吗?
不是。这些标签是基于宽泛的数值代码点范围生成的,仅供参考,不应被视为权威的 Unicode 标准块、脚本或语言分类。
工具是否处理组合字符或字形簇?
不。此工具按迭代字符串字符进行处理,而不是按用户感知的字形簇或标准化后的文本进行分析。组合字符可能会被单独列出。