異體字查詢

Share:

免費異體字查詢工具。輸入漢字,即可查詢其異體字(語義變體)、簡繁對應、Z-變體、特殊異體與混淆字,資料來自 Unicode Unihan 資料庫。瀏覽器本地運行,不上傳任何輸入。

RT-TXT-056 · Text Tools

異體字查詢

輸入一個或多個漢字,本工具按 Unicode Unihan 資料庫列出其各類異體字。所有查詢均在瀏覽器本地完成,不上傳、不儲存任何輸入。

Advertisement
After results · AD-W1 Responsive

使用方法

輸入漢字

在輸入框中輸入一個或多個漢字,可用空格分隔,也可直接貼上一段文字——工具會自動擷取其中的漢字並去重。

查詢異體字

點擊「查詢異體字」。每個字會生成一張卡片,按類別列出它的異體字、簡化字、繁體字、Z-變體、特殊異體與混淆字。

點擊異體字繼續查

結果中每個異體字都是可點擊的按鈕。點一下即可把它放進輸入框並查詢該字的異體字,方便順藤摸瓜地追溯字形關係。

理解類別

各類別對應 Unihan 資料庫欄位:異體字=語義變體,簡化字/繁體字=簡繁對應,Z-變體=可統一的同形變體,特殊異體=特定語義變體,混淆字=形近易混字。

異體字:一字多形的漢字世界

漢字在數千年的演變中,常常出現「同一個字、不同寫法」的現象,這些彼此意義相同、讀音相同而字形不同的字,就稱為異體字(又稱或體、俗體)。例如「群」與「羣」、「峰」與「峯」、「裡」與「裏」,都是同一個字的不同書寫形態。異體字的產生原因多樣:有的是偏旁位置上下與左右互換,有的是簡筆與繁筆並存,有的是歷代抄寫、刻印、避諱與方俗用字累積下來的差異。本工具直接調用 Unicode Unihan 資料庫中的異體關係欄位,把一個字在資料庫中記錄的各類變體一次列出,幫助你快速對照字形。

六類變體分別代表什麼

Unihan 用不同欄位記錄不同性質的字形關係,本工具據此分為六類:異體字(語義變體,kSemanticVariant)是意義可互通的異寫;簡化字(kSimplifiedVariant)繁體字(kTraditionalVariant)是 1956 年起推行的簡化方案所建立的簡繁對應,如「国↔國」「变↔變」;Z-變體(kZVariant)指字形差異極小、在 Unicode 中本可統一卻因來源不同而分別編碼的字;特殊異體(kSpecializedSemanticVariant)是僅在特定義項下才相通的變體;混淆字(kSpoofingVariant)則是形近易混、可能被用於視覺欺騙(如網域仿冒)的字。理解這些區別,才能正確判斷兩個字是否真能互換。

誰會用到異體字查詢

異體字查詢在多個場景中很實用:古籍整理與校勘需要辨認刻本中的俗寫異體;姓名與證件處理常遇到「同名不同字」的繁簡或異體問題,尤其在港澳台與海外華人社群;排版與字庫開發要確認某字形是否有規範對應;資訊安全領域則關注混淆字(Z-變體與 spoofing)帶來的同形異義攻擊風險。需要提醒的是,Unihan 記錄的是客觀的字形對照關係,而非用字規範建議——某字在資料庫中有異體,並不意味著在你的具體語境(如繁體規範、教科書用字)中可以隨意替換。請結合現行規範與實際用途判斷。本工具所有查詢均在瀏覽器本地完成,不上傳、不儲存任何輸入。

「異體字不是錯字,而是同一個字在歷史與地域中留下的不同身影。」

關於資料來源

本工具的異體關係全部來自 Unicode® Unihan 資料庫(Unihan_Variants.txt)——這是 Unicode 聯盟維護的、涵蓋數萬漢字的權威字元屬性資料,被全球作業系統、字庫與輸入法廣泛採用。它由各國(中、日、韓、越等)的標準機構共同貢獻,因此同一個字可能同時記錄來自不同來源的多種變體。資料為客觀的碼點對照,本工具僅作本地查詢展示,不增刪、不主觀裁定哪一種寫法「正確」。如需用於出版或正式文書,請再以現行國家/地區的用字規範核對。

Advertisement
After how-to · AD-W2 Responsive

關於異體字的 10 個事實

01

「異體字」指意義、讀音相同而寫法不同的字,如「群/羣」「峰/峯」。它們是同一個字,不是錯別字。

02

本工具的異體關係全部來自 Unicode Unihan 資料庫,這是全球作業系統與字庫共用的權威漢字屬性資料。

03

簡化字與繁體字其實是異體關係的一種:「国↔國」「变↔變」就是 kSimplifiedVariant 與 kTraditionalVariant 欄位記錄的對應。

04

Z-變體(kZVariant)指字形幾乎相同、本可在 Unicode 統一卻因來源不同而分別編碼的字,差異常常肉眼難辨。

05

混淆字(kSpoofingVariant)是形近易混的字,資訊安全領域關注它帶來的「同形網域」仿冒等視覺欺騙風險。

06

同一個字可能同時有多類變體。Unihan 由中、日、韓、越等多國標準機構共同貢獻,來源不同會帶來不同記錄。

07

異體字未必能隨處替換:Unihan 記錄的是客觀字形對照,不是用字規範——某字有異體,不代表在你的語境裡可以互換。

08

特殊異體(kSpecializedSemanticVariant)只在某個特定義項下才與本字相通,其他義項下並不通用。

09

異體字在古籍校勘、姓名證件處理與字庫開發中都很常見,尤其港澳台與海外華人社群常遇繁簡異寫問題。

10

本工具完全在瀏覽器本地運行,資料為一次性載入的本地 JSON,不上傳、不儲存任何輸入,也無任何伺服器呼叫。

常見問題

  • 異體字是意義、讀音都相同,只是寫法不同的字,例如「群/羣」「峰/峯」「裡/裏」。它們是同一個字的不同書寫形態,不是錯別字。異體字的產生原因包括偏旁位置互換、簡繁筆並存,以及歷代抄寫、刻印、避諱與方俗用字的累積。

  • 全部來自 Unicode® Unihan 資料庫(Unihan_Variants.txt),這是 Unicode 聯盟維護、涵蓋數萬漢字的權威字元屬性資料,被全球作業系統、字庫與輸入法廣泛採用。它由中、日、韓、越等多國標準機構共同貢獻。本工具只作本地查詢展示,不增刪資料。

  • 異體字=語義變體(kSemanticVariant,意義可互通);簡化字/繁體字=簡繁對應(kSimplifiedVariant / kTraditionalVariant,如国↔國);Z-變體=字形幾乎相同、本可統一卻分別編碼的字(kZVariant);特殊異體=僅在特定義項下相通(kSpecializedSemanticVariant);混淆字=形近易混、可能用於視覺欺騙(kSpoofingVariant)。

  • 在 Unihan 的框架裡,簡繁對應被記錄為專門的 kSimplifiedVariant 與 kTraditionalVariant 欄位,屬於變體關係的一種。本工具會把它們單獨歸入「簡化字」「繁體字」兩類顯示,例如查「国」會顯示繁體「國」,查「変」會顯示對應字「變」。

  • 不一定。Unihan 記錄的是客觀的字形對照關係,而不是用字規範建議。某字在資料庫裡有異體,並不意味著在你的具體語境(繁體規範、教科書用字、正式文書)裡就能隨意替換。特殊異體更是只在某個義項下相通。請結合現行國家/地區規範與實際用途判斷。

  • 因為 Unihan 資料庫裡並未為該字記錄任何異體關係——很多常用字本身沒有被收錄的異體,或其異體未進入 Unicode 標準。這時工具會顯示「該字暫無收錄的異體字」。這不代表它一定沒有任何歷史異寫,只代表權威資料庫中目前沒有相應記錄。

  • 可以。你可以輸入多個字(用空格分隔),甚至直接貼上一整段文字——工具會自動擷取其中的漢字、去掉重複,並為每個字生成一張異體字卡片。結果中的每個異體字都可點擊,繼續追溯。

  • 不會。本工具完全在瀏覽器本地運行,異體字資料是一次性載入的本地 JSON 檔案,查詢過程沒有任何伺服器呼叫,也不上傳、不儲存你輸入的任何文字。

  • 混淆字(kSpoofingVariant)與 Z-變體是形近、肉眼難辨的字。攻擊者可用它們構造「同形」的網址或帳號名(homograph attack),讓使用者誤以為是正牌站點。開發者與安全團隊可藉助這類資料,辨識並過濾可能被仿冒利用的字形。

  • 建議再核對。本工具展示的是 Unihan 的客觀字形對照,可作為研究、校勘與開發的參考起點;但出版、教科書、正式文書等有各自的用字規範。請以現行國家/地區標準為準,本工具不構成用字規範建議。

Related News

You may be interested in these recent stories from our newsroom.

View all news →
Advertisement
Pre-footer · AD-W3 728 × 90