簡繁轉換

貼上中文文字,自動辨識簡繁並轉換。

為什麼逐字轉換不夠用

簡體和繁體並不是簡單的一對一對應。一個簡體字常常對應多個繁體字,取決於含義:发 → 發(發送)或 髮(頭髮),后 → 後(之後)或 后(皇后),干 → 幹、乾 或 干。逐字替換的轉換器產出的文字,母語讀者一眼就能看出是機器產生的。本工具使用 OpenCC 的字典,在詞組層面轉換並依上下文選擇正確的字形——這也是維基百科和眾多出版流程採用的引擎。

除了字形,台灣與香港在詞彙和部分字形標準上既彼此不同,也與大陸不同。软件在台灣是「軟體」,在香港是「軟件」;鼠标在台灣是「滑鼠」。「含詞彙」的選項會一併轉換這些地區詞彙,對於面向特定市場的產品介面、行銷文案和字幕尤為重要。

使用方法

把文字貼到左側框。開啟「自動辨識」時,工具會檢查字元並選擇合理的方向:簡體輸入轉為繁體(台灣,含詞彙),繁體輸入轉為簡體。隨時可以在下拉選單手動指定方向——手動選擇後本次工作階段的自動辨識會關閉。轉換結果顯示在右側;「複製」放入剪貼簿,「交換」把輸出送回輸入,方便比較往返結果。

轉換字典在首次使用時下載(簡轉繁約 1 MB,反向小得多),隨後由瀏覽器快取,之後的轉換即時完成並可離線使用。文字本身不會傳送到任何地方。

該選哪個方向

面向台灣讀者,用「簡體 → 繁體(台灣,含詞彙)」;想保留大陸詞彙但使用台灣字形則選不含詞彙的版本。面向香港,用香港變體,它遵循 HKSCS 字形標準。「簡體 → 繁體(標準)」是面向古籍或跨地區讀者的中性選擇。反向時,「繁體(台灣,含詞彙)→ 簡體」還會把台灣詞彙換回大陸用語,正是發往大陸的文件所需要的。

背景:兩種書寫系統,一種語言

簡化字由中華人民共和國在 1956 年和 1964 年推行,目的是提高識字率,減少了約 2,000 個常用字的筆畫,並把一些同音字合併為一個字形。台灣、香港和澳門保留了傳統字形,後來各自獨立標準化——台灣教育部標準與香港 HKSCS 在字形細節上有差異。本轉換器背後的開源專案 OpenCC 由郭家寶(BYVoid)於 2010 年創立,做到了早期工具做不到的事:藉助社群持續維護的精選字典,轉換詞組和地區詞彙,而不只是逐字替換。

應用領域

軟體在地化是最大的用途:一份 zh-CN 字串檔幾秒鐘變成 zh-TW 和 zh-HK 版本,再由母語者審校詞彙。出版社在大陸版與台灣版書稿之間轉換;字幕組同時發布兩個版本;電商賣家為台灣和香港市場在地化商品頁;研究者在檢索或分析前先統一混合書寫系統的語料。維基百科用同樣的方法從一份原始文本為每篇中文條目提供多個變體。如果你在在地化整個產品,把它和 JSON 格式化搭配處理字串檔、和字數統計搭配檢查轉換後的文案是否仍在長度限制內,並保持轉換文字處於審校狀態——少數詞(尤其是技術術語和品牌名)永遠需要人來決定。想精確看到轉換到底改了哪些字,把兩個版本放進文字比對。

常見問題

這是翻譯嗎?

不是。兩種書寫系統寫的是同一種語言,本工具轉換的是書寫系統和(可選的)地區詞彙,文法和含義完全不變。

為什麼某個字沒有轉換?

有些字在兩種書寫系統中相同,一些專有名詞也會刻意保留。若某個詞轉換有誤,可開啟含詞彙模式,或在轉換後手動修改。

台灣繁體和香港繁體有什麼差別?

主要是字形標準(如 為 與 爲、裏 與 裡)和詞彙。依你的受眾選擇對應變體。

我的文字會被上傳嗎?

不會。字典下載到你的瀏覽器,轉換在本機完成。

一次能轉換多少文字?

沒有固定限制;現代裝置上幾萬字在一秒內即可完成。