异体字查询

Share:

免费异体字查询工具。输入汉字,即可查询其异体字(语义变体)、简繁对应、Z-变体、特殊异体与混淆字,数据来自 Unicode Unihan 数据库。浏览器本地运行,不上传任何输入。

RT-TXT-056 · Text Tools

异体字查询

输入一个或多个汉字,本工具按 Unicode Unihan 数据库列出其各类异体字。所有查询均在浏览器本地完成,不上传、不储存任何输入。

Advertisement
After results · AD-W1 Responsive

使用方法

输入汉字

在输入框中输入一个或多个汉字,可用空格分隔,也可直接粘贴一段文字——工具会自动提取其中的汉字并去重。

查询异体字

点击「查询异体字」。每个字会生成一张卡片,按类别列出它的异体字、简化字、繁体字、Z-变体、特殊异体与混淆字。

点击异体字继续查

结果中每个异体字都是可点击的按钮。点一下即可把它放进输入框并查询该字的异体字,方便顺藤摸瓜地追溯字形关系。

理解类别

各类别对应 Unihan 数据库字段:异体字=语义变体,简化字/繁体字=简繁对应,Z-变体=可统一的同形变体,特殊异体=特定语义变体,混淆字=形近易混字。

异体字:一字多形的汉字世界

汉字在数千年的演变中,常常出现「同一个字、不同写法」的现象,这些彼此意义相同、读音相同而字形不同的字,就称为异体字(又称或体、俗体)。例如「群」与「羣」、「峰」与「峯」、「裡」与「裏」,都是同一个字的不同书写形态。异体字的产生原因多样:有的是偏旁位置上下与左右互换,有的是简笔与繁笔并存,有的是历代抄写、刻印、避讳与方俗用字累积下来的差异。本工具直接调用 Unicode Unihan 数据库中的异体关系字段,把一个字在数据库中记录的各类变体一次列出,帮助你快速对照字形。

六类变体分别代表什么

Unihan 用不同字段记录不同性质的字形关系,本工具据此分为六类:异体字(语义变体,kSemanticVariant)是意义可互通的异写;简化字(kSimplifiedVariant)繁体字(kTraditionalVariant)是 1956 年起推行的简化方案所建立的简繁对应,如「国↔國」「变↔變」;Z-变体(kZVariant)指字形差异极小、在 Unicode 中本可统一却因来源不同而分别编码的字;特殊异体(kSpecializedSemanticVariant)是仅在特定义项下才相通的变体;混淆字(kSpoofingVariant)则是形近易混、可能被用于视觉欺骗(如域名仿冒)的字。理解这些区别,才能正确判断两个字是否真能互换。

谁会用到异体字查询

异体字查询在多个场景中很实用:古籍整理与校勘需要辨认刻本中的俗写异体;姓名与证件处理常遇到「同名不同字」的繁简或异体问题,尤其在港澳台与海外华人社群;排版与字库开发要确认某字形是否有规范对应;信息安全领域则关注混淆字(Z-变体与 spoofing)带来的同形异义攻击风险。需要提醒的是,Unihan 记录的是客观的字形对照关系,而非用字规范建议——某字在数据库中有异体,并不意味着在你的具体语境(如简体规范、教科书用字)中可以随意替换。请结合现行规范与实际用途判断。本工具所有查询均在浏览器本地完成,不上传、不储存任何输入。

「异体字不是错字,而是同一个字在历史与地域中留下的不同身影。」

关于数据来源

本工具的异体关系全部来自 Unicode® Unihan 数据库(Unihan_Variants.txt)——这是 Unicode 联盟维护的、覆盖数万汉字的权威字符属性资料,被全球操作系统、字库与输入法广泛采用。它由各国(中、日、韩、越等)的标准机构共同贡献,因此同一个字可能同时记录来自不同来源的多种变体。数据为客观的码点对照,本工具仅作本地查询展示,不增删、不主观裁定哪一种写法「正确」。如需用于出版或正式文书,请再以现行国家/地区的用字规范核对。

Advertisement
After how-to · AD-W2 Responsive

关于异体字的 10 个事实

01

「异体字」指意义、读音相同而写法不同的字,如「群/羣」「峰/峯」。它们是同一个字,不是错别字。

02

本工具的异体关系全部来自 Unicode Unihan 数据库,这是全球操作系统与字库共用的权威汉字属性资料。

03

简化字与繁体字其实是异体关系的一种:「国↔國」「变↔變」就是 kSimplifiedVariant 与 kTraditionalVariant 字段记录的对应。

04

Z-变体(kZVariant)指字形几乎相同、本可在 Unicode 统一却因来源不同而分别编码的字,差异常常肉眼难辨。

05

混淆字(kSpoofingVariant)是形近易混的字,信息安全领域关注它带来的「同形域名」仿冒等视觉欺骗风险。

06

同一个字可能同时有多类变体。Unihan 由中、日、韩、越等多国标准机构共同贡献,来源不同会带来不同记录。

07

异体字未必能随处替换:Unihan 记录的是客观字形对照,不是用字规范——某字有异体,不代表在你的语境里可以互换。

08

特殊异体(kSpecializedSemanticVariant)只在某个特定义项下才与本字相通,其他义项下并不通用。

09

异体字在古籍校勘、姓名证件处理与字库开发中都很常见,尤其港澳台与海外华人社群常遇繁简异写问题。

10

本工具完全在浏览器本地运行,数据为一次性加载的本地 JSON,不上传、不储存任何输入,也无任何服务器调用。

常见问题

  • 异体字是意义、读音都相同,只是写法不同的字,例如「群/羣」「峰/峯」「裡/裏」。它们是同一个字的不同书写形态,不是错别字。异体字的产生原因包括偏旁位置互换、简繁笔并存,以及历代抄写、刻印、避讳与方俗用字的累积。

  • 全部来自 Unicode® Unihan 数据库(Unihan_Variants.txt),这是 Unicode 联盟维护、覆盖数万汉字的权威字符属性资料,被全球操作系统、字库与输入法广泛采用。它由中、日、韩、越等多国标准机构共同贡献。本工具只作本地查询展示,不增删数据。

  • 异体字=语义变体(kSemanticVariant,意义可互通);简化字/繁体字=简繁对应(kSimplifiedVariant / kTraditionalVariant,如国↔國);Z-变体=字形几乎相同、本可统一却分别编码的字(kZVariant);特殊异体=仅在特定义项下相通(kSpecializedSemanticVariant);混淆字=形近易混、可能用于视觉欺骗(kSpoofingVariant)。

  • 在 Unihan 的框架里,简繁对应被记录为专门的 kSimplifiedVariant 与 kTraditionalVariant 字段,属于变体关系的一种。本工具会把它们单独归入「简化字」「繁体字」两类显示,例如查「国」会显示繁体「國」,查「変」会显示对应字「變」。

  • 不一定。Unihan 记录的是客观的字形对照关系,而不是用字规范建议。某字在数据库里有异体,并不意味着在你的具体语境(简体规范、教科书用字、正式文书)里就能随意替换。特殊异体更是只在某个义项下相通。请结合现行国家/地区规范与实际用途判断。

  • 因为 Unihan 数据库里并未为该字记录任何异体关系——很多常用字本身没有被收录的异体,或其异体未进入 Unicode 标准。这时工具会显示「该字暂无收录的异体字」。这不代表它一定没有任何历史异写,只代表权威数据库中目前没有相应记录。

  • 可以。你可以输入多个字(用空格分隔),甚至直接粘贴一整段文字——工具会自动提取其中的汉字、去掉重复,并为每个字生成一张异体字卡片。结果中的每个异体字都可点击,继续追溯。

  • 不会。本工具完全在浏览器本地运行,异体字数据是一次性加载的本地 JSON 文件,查询过程没有任何服务器调用,也不上传、不储存你输入的任何文字。

  • 混淆字(kSpoofingVariant)与 Z-变体是形近、肉眼难辨的字。攻击者可用它们构造「同形」的网址或账号名(homograph attack),让用户误以为是正牌站点。开发者与安全团队可借助这类数据,识别并过滤可能被仿冒利用的字形。

  • 建议再核对。本工具展示的是 Unihan 的客观字形对照,可作为研究、校勘与开发的参考起点;但出版、教科书、正式文书等有各自的用字规范。请以现行国家/地区标准为准,本工具不构成用字规范建议。

Related News

You may be interested in these recent stories from our newsroom.

View all news →
Advertisement
Pre-footer · AD-W3 728 × 90