文章

「泰瑞輸入法查碼與查字」網頁(漢字查拆碼/拆碼查漢字)及其利用的碼表

筆者多年前就已經整理了在台灣較常見的輸入法(倉頡、注音、大易、行列、無蝦米)的碼表,
但是因為筆者沒有學過程式設計,所以未能將這些碼表的運用發揮到極致,
只能將它們套用到輸入法框架軟體中去使用。
近年來因為 ChatGPT、Claude、Copilot、Gemini、Grok…等 AI 工具的興起,
不具備程式碼寫作能力也沒有關係,把需求告知 AI,它就能幫忙寫好程式碼,
於是筆者就利用 Grok 寫出一支「泰瑞輸入法查碼與查字」的網頁,網址如下:
https://terryjiun.github.io/findcode/
它支援倉頡、注音、大易、行列、無蝦米的「正查」(以碼查字)與「反查」(以字查碼)。

它使用的碼表是筆者2016年曾經發布過的「泰瑞系列中文輸入法對照表」,
這些對照表(碼表)冠上「泰瑞」(筆者的筆名)是因為筆者清楚它們的來源,
也確保過由筆者指定的 CJK 字元集的每個漢字全部都有收錄到碼表裡,如果有缺字則由筆者補上。
但是筆者不確保每個漢字對應的拆碼都符合公認的規則,如果編碼存有爭議,筆者傾向全都收錄。

有感於筆者2016年發布的注音碼表至今已過舊,
且筆者於2019年發表【全字庫(CNS11643)字型、屬性、授權方式更新情況】一文時,
曾經提到【…「全字庫注音」應已支援 CJK Ext-C/D 字元集…等筆者有空再來更新至支援 CJK Ext-C/D 字元集】,
這個當初自己挖的坑一直未填補,所以趁著做這個「泰瑞輸入法查碼與查字」網頁的機會,在今年(2026年)一起補上。

以上 5 個輸入法碼表的最新情形及筆者的更新規劃說明如下:
1.泰瑞倉頡:
 原本(2016年版本,以下提及「原本」者,皆同)支援到 CJK Ext-D,今年已升級到支援到 CJK Ext-J,
 並以「附加」全字庫倉頡屬性(中標倉頡,20260805版本)的方式對原本發布的版本進行「擴充」。
 擴充後幾乎不會變更原本 Big5 重碼字的順序,但是會多出一些容錯碼。
 之所以產生容錯碼,情況大多是因為一些漢字在不同的字型下呈現出的筆型不同,
 而讓人理解到不同的取碼方式。
2.泰瑞注音:
 原本支援到 CJK Ext-B,今年已升級到支援到 CJK Ext-D,
 以全部「替換」成全字庫注音屬性(中標注音,20260805版本)的方式對原本發布的版本進行擴充。
 筆者替全字庫的注音屬性表格補字時,有先查詢過各缺漏字在澳典、漢典上標示的注音,
 如果這兩部字典都沒有標示全字庫缺漏字的注音,筆者一律將其注音標示為ㄅㄧㄤˋ。
 (注意!全字庫對於未知讀音的漢字一律將其注音標示為ㄇㄡˇ) 3.大易四碼:
 原本支援到 CJK Ext-A,今年保持不變,筆者將來升級大易碼表的可能性趨近於零。
4.行列三十:
 原本支援到 CJK Ext-D,今年保持不變,筆者將來升級行列碼表的可能性不高。
 目前網路上已有支援到 CJK Ext-J 的版本,欲升級者請自行到 GitHub【行列輸入法表格】下載,
 此版維護人是以前「老刀烏白講」Blog 的站長─老刀(本名葉光哲)與行列輸入法發明人廖明德。
5.無蝦米:
 原本支援到 CJK Ext-D,今年保持不變,筆者將來升級無蝦米碼表的可能性趨近於零。

另外,這個「泰瑞輸入法查碼與查字」網頁也可以彌補 Windows 10/11 內建的微軟倉頡不支援 CJK Ext-C~J 字元的缺陷,
如果不常使用罕見字,平常只使用 CJK URO(基本區)字元的話,
就算不會調整微軟倉頡使用擴充區字元集也沒有關係,
以想要輸入「䕒」(CJK Ext-A 字元)為例,
直接連上「泰瑞輸入法查碼與查字」網頁後,先點「倉頡」,輸入「tgrr」(廿土口口),再按「查詢」,
就會查到「䕒」字,點選該字就能直接複製,再到想輸入的地方貼上就好。

筆者有想過把這個「泰瑞輸入法查碼與查字」網頁再擴充得完善一點,
比如:一次可以同時查出某個漢字的倉頡、注音、大易、行列、無蝦米的拆碼,
但是因為各碼表支援的字元集不同(有的多、有的少),而且載入全部碼表的話,等待時間會拉得很長,
查詢結果頁面也會變得很凌亂,於是作罷!
又比如:一次可以查詢一長串漢字(或拆碼),結果頁面只列出選擇的輸入法下,
這一長串漢字對應的拆碼(或這一長串拆碼對應的漢字),而其他資訊則不顯示,
但是因為有些漢字一字有多種拆碼,或一種拆碼對應多個漢字(此情況注音輸入法特別常見),
勉強叫 AI 寫出程式碼的話,查詢結果頁面也會變得異常複雜,於是又作罷!
筆者對於輸入法作品的立場一向都是「先求有,再求好」,所以現階段就先處理到這樣!

本文章以 CC BY-NC 4.0 授權