按名反查:输入 heart,列出所有相关码点
code point 检视器是「拿一段文本拆出码点」(读),
受控输入框是「往文本里写码点」(写)——这页补上第三件:反过来按名字找码点(查)。
每个码点在 UCD 里有一个固定的英文 Unicode 名(如 ❤ 的名是 HEAVY BLACK HEART);
输入一个英文子串,下面就把名字里含这个词的全部码点列出来,按 Block 分组,
每个都标 General_Category。试试 heart、arrow、triangle、face。
heart)、
码位 hex(如 2764 或 U+2764)、粘一个字符(直接反查这个字符叫什么)。
命中的子串在名字里高亮。结果太多时只渲染前若干个(右下角给出完整匹配数),缩小关键词即可看全。
UnicodeData.txt,
刻意排除两类:其一 CJK / Hangul / Tangut 等用算法名批量命名的大区间(如「CJK UNIFIED IDEOGRAPH-XXXX」,
按英文名搜没有意义,且有十几万个会拖垮页面);其二 <control> / <surrogate>
这类尖括号占位名(没有真正的字符名)。所以汉字按拼音 / 字形查不到——那属于
Han 统一与 拼音两页的范畴。
U+XXXX 可跳到
codepoints.net 看该码点的完整档案。
相关链接
-
Codepoints · 逐码点数据库 · codepoints.net
本页每个结果的
U+都直链到这里:查任意码点的名称、gc、block、各编码字节、相关字符——本页是它「按名搜」那一格的离线精简版。 -
Unicode Character Name Index · unicode.org
官方的「字符名索引」:按英文名的关键词查码点的权威来源,本页的名字数据(
UnicodeData.txt)和它同源。 - UAX #34 · Unicode Named Character Sequences · unicode.org 字符「名字」从哪来、算法名(CJK / Hangul)如何派生的规范——解释了本页为什么把那些大区间排除在按名搜之外。