Neatbo.

Unicode 字符检查

逐个查看 Unicode 码点、正式名称或控制字符别名、UTF-8 字节及原文位置。

浏览器本地处理输入TXT输出JSON单个文件最多 10 MiB · 最多 1 个
  1. 1添加输入
  2. 2确认后运行
  3. 3获取结果

工具输入和文件在当前浏览器处理,不会上传。

输入内容

切换工具时在当前标签页临时保留输入。刷新或关闭后清除,较大的结果可能需要重新生成。

⌘ / Ctrl + Enter 运行
检查来源
0 个字符 · 0 字节
正在准备处理工具…

开始之前

粘贴文本或选择一个 UTF-8 文件,找出显示文字背后的准确码点。可按码点、名称或字节搜索全部结果,并导出完整 JSON 或 CSV。

如何使用

  1. 粘贴文本或选择一个 UTF-8 文本文件。
  2. 运行后按码点、Unicode 名称或 UTF-8 字节搜索完整结果,核对原文行列位置。
  3. 将匹配行复制为 JSON,或复制完整 JSON;也可下载完整的 JSON 或 CSV 报告。

支持范围与限制

每次最多检查 10,000 个 Unicode 码点。粘贴文本最多 1 MiB;单个 UTF-8 .txt/.md 文件最多 10 MiB、50,000 个物理行。

名称来自 Unicode 18.0.0。控制字符显示 Unicode 别名;私用和未分配码点没有正式名称。文件开头的 BOM 可能在 UTF-8 解码时被消耗。

每行表示一个码点,并非完整的可见字素簇,也不判断视觉混淆字符是否等价。输入仅在本浏览器处理。

操作示例

示例输入

A中
示例参数
{}

示例输出

[
  {
    "index": 1,
    "line": 1,
    "column": 1,
    "character": "A",
    "codepoint": "U+0041",
    "name": "LATIN CAPITAL LETTER A",
    "nameType": "formal",
    "utf8": "41"
  },
  {
    "index": 2,
    "line": 1,
    "column": 2,
    "character": "中",
    "codepoint": "U+4E2D",
    "name": "CJK UNIFIED IDEOGRAPH-4E2D",
    "nameType": "formal",
    "utf8": "e4 b8 ad"
  }
]

出现问题时

如果文本文件无法读取,请确认它是有效的 UTF-8。超过 10,000 个码点时,请截取较小片段检查,并保留原文供核对。

常见问题

为什么一个可见符号会占多行?

Emoji 序列和组合附加符号可能含多个 Unicode 码点。每行按原文顺序表示一个码点;视觉占位符不是替换字符。

每个码点都有名称吗?

已分配字符显示 Unicode 18.0.0 正式名称;控制字符显示官方别名。私用及未分配码点没有正式名称。

能比较两段文字或识别视觉仿冒吗?

不能。工具只列出一份输入的码点、名称、字节和位置;两份报告需自行比较。视觉混淆检测与规范化属于不同任务。

输入会发送到服务器吗?

不会。文本和所选文件仅在浏览器处理。刷新或关闭标签页前请保存需要的报告。

文档与延伸阅读

相关工具