简繁转换

粘贴中文文本,自动识别简繁并转换。

为什么逐字转换不够用

简体和繁体并不是简单的一对一映射。一个简体字常常对应多个繁体字,取决于含义:发 → 發(发送)或 髮(头发),后 → 後(之后)或 后(皇后),干 → 幹、乾 或 干。逐字替换的转换器产出的文本,母语读者一眼就能看出是机器生成的。本工具使用 OpenCC 的词典,在词组层面转换并根据上下文选择正确的字形——这也是维基百科和众多出版流程采用的引擎。

除了字形,台湾与香港在词汇和部分字形标准上既彼此不同,也与大陆不同。软件在台湾是「軟體」,在香港是「軟件」;鼠标在台湾是「滑鼠」。「含词汇」的选项会一并转换这些地区词汇,对于面向特定市场的产品界面、营销文案和字幕尤为重要。

使用方法

把文本粘贴到左侧框。开启「自动识别」时,工具会检查字符并选择合理的方向:简体输入转为繁体(台湾,含词汇),繁体输入转为简体。随时可以在下拉框手动指定方向——手动选择后本次会话的自动识别会关闭。转换结果显示在右侧;「复制」放入剪贴板,「交换」把输出送回输入,方便比较往返结果。

转换词典在首次使用时下载(简转繁约 1 MB,反向小得多),随后由浏览器缓存,之后的转换即时完成并可离线使用。文本本身不会发送到任何地方。

该选哪个方向

面向台湾读者,用「简体 → 繁体(台湾,含词汇)」;想保留大陆词汇但使用台湾字形则选不含词汇的版本。面向香港,用香港变体,它遵循 HKSCS 字形标准。「简体 → 繁体(标准)」是面向古籍或跨地区读者的中性选择。反向时,「繁体(台湾,含词汇)→ 简体」还会把台湾词汇换回大陆用语,正是发往大陆的文档所需要的。

背景:两种书写系统,一种语言

简化字由中华人民共和国在 1956 年和 1964 年推行,目的是提高识字率,减少了约 2,000 个常用字的笔画,并把一些同音字合并为一个字形。台湾、香港和澳门保留了传统字形,后来各自独立标准化——台湾教育部标准与香港 HKSCS 在字形细节上有差异。本转换器背后的开源项目 OpenCC 由郭家宝(BYVoid)于 2010 年创立,做到了早期工具做不到的事:借助社区持续维护的精选词典,转换词组和地区词汇,而不只是逐字替换。

应用领域

软件本地化是最大的用途:一份 zh-CN 字符串文件几秒钟变成 zh-TW 和 zh-HK 版本,再由母语者审校词汇。出版社在大陆版与台湾版书稿之间转换;字幕组同时发布两个版本;电商卖家为台湾和香港市场本地化商品页;研究者在检索或分析前先统一混合书写系统的语料。维基百科用同样的方法从一份源文本为每篇中文条目提供多个变体。如果你在本地化整个产品,把它和 JSON 格式化配合处理字符串文件、和字数统计配合检查转换后的文案是否仍在长度限制内,并保持转换文本处于审校状态——少数词(尤其是技术术语和品牌名)永远需要人来决定。想精确看到转换到底改了哪些字,把两个版本放进文本对比。

常见问题

这是翻译吗?

不是。两种书写系统写的是同一种语言,本工具转换的是书写系统和(可选的)地区词汇,语法和含义完全不变。

为什么某个字没有转换?

有些字在两种书写系统中相同,一些专有名词也会刻意保留。若某个词转换有误,可开启含词汇模式,或在转换后手动修改。

台湾繁体和香港繁体有什么区别?

主要是字形标准(如 為 与 爲、裏 与 裡)和词汇。按你的受众选择对应变体。

我的文本会被上传吗?

不会。词典下载到你的浏览器,转换在本地完成。

一次能转换多少文本?

没有固定限制;现代设备上几万字在一秒内即可完成。