Unicode 字符检查
逐个查看 Unicode 码点、正式名称或控制字符别名、UTF-8 字节及原文位置。
浏览器本地处理输入TXT输出JSON单个文件最多 10 MiB · 最多 1 个
- 1添加输入
- 2确认后运行
- 3获取结果
工具输入和文件在当前浏览器处理,不会上传。
开始之前
粘贴文本或选择一个 UTF-8 文件,找出显示文字背后的准确码点。可按码点、名称或字节搜索全部结果,并导出完整 JSON 或 CSV。
如何使用
- 粘贴文本或选择一个 UTF-8 文本文件。
- 运行后按码点、Unicode 名称或 UTF-8 字节搜索完整结果,核对原文行列位置。
- 将匹配行复制为 JSON,或复制完整 JSON;也可下载完整的 JSON 或 CSV 报告。
支持范围与限制
每次最多检查 10,000 个 Unicode 码点。粘贴文本最多 1 MiB;单个 UTF-8 .txt/.md 文件最多 10 MiB、50,000 个物理行。
名称来自 Unicode 18.0.0。控制字符显示 Unicode 别名;私用和未分配码点没有正式名称。文件开头的 BOM 可能在 UTF-8 解码时被消耗。
每行表示一个码点,并非完整的可见字素簇,也不判断视觉混淆字符是否等价。输入仅在本浏览器处理。
操作示例
示例输入
A中
示例参数
{}示例输出
[
{
"index": 1,
"line": 1,
"column": 1,
"character": "A",
"codepoint": "U+0041",
"name": "LATIN CAPITAL LETTER A",
"nameType": "formal",
"utf8": "41"
},
{
"index": 2,
"line": 1,
"column": 2,
"character": "中",
"codepoint": "U+4E2D",
"name": "CJK UNIFIED IDEOGRAPH-4E2D",
"nameType": "formal",
"utf8": "e4 b8 ad"
}
]出现问题时
如果文本文件无法读取,请确认它是有效的 UTF-8。超过 10,000 个码点时,请截取较小片段检查,并保留原文供核对。
常见问题
为什么一个可见符号会占多行?
Emoji 序列和组合附加符号可能含多个 Unicode 码点。每行按原文顺序表示一个码点;视觉占位符不是替换字符。
每个码点都有名称吗?
已分配字符显示 Unicode 18.0.0 正式名称;控制字符显示官方别名。私用及未分配码点没有正式名称。
能比较两段文字或识别视觉仿冒吗?
不能。工具只列出一份输入的码点、名称、字节和位置;两份报告需自行比较。视觉混淆检测与规范化属于不同任务。
输入会发送到服务器吗?
不会。文本和所选文件仅在浏览器处理。刷新或关闭标签页前请保存需要的报告。