墨有浓淡,字有正俗
让繁体回归规范

一套以《通用规范汉字表》(2013)为准绳的繁体字形转换程序。 将港、台标准及旧字形、异体字混杂的“繁体”,统一转换为内地繁体出版的规范字形。

转换方案
柒类支持文件格式
1.4.1OpenCC 引擎
全平台Win / Linux
卷 一

牛刀小试

输入一段繁体文本,感受「非标准字形 → 规范繁体」的转换效果。

本次转换共命中 0 处字形(朱砂色标出)。 正在加载 opencc-wasm 引擎……
卷 二

功能特性

不止一张字表——从图形界面到 AI 辅助转换,为繁体出版、古籍整理与字幕制作而生。

多格式批量转换

支持 Word(DOC / DOCX,可保留格式)、TXT、EPUB 电子书与 SRT、ASS / SSA、LRC 字幕文件,可选定文件夹内文件批量处理。

AI 繁简转换模块

内置独立 AI 转换模块,与传统 OpenCC 引擎互为补充,处理棘手的一对多、语境用字。

结巴分词加持

离线转换前可选开启结巴分词,含古汉语专用词典,显著提升歧义字的转换准确度。

智能编码检测

自动检测文本文件(TXT)编码,亦可强制按指定编码读取;与其他文件编码逻辑独立处理,互不干扰。

现代图形界面

基于 PySide6 构建,支持明暗主题、转换中途取消、在线检查更新,开箱即用,无需命令行。

全平台覆盖

提供 Windows 11 / 10 / 7 安装包,Deepin / GXDE 提供 deb 包;源码在 Github 完全公开,亦支持从源码自行部署。

输入法级输出

转换方案可接入小狼毫(Rime)输入法,让输入法直接打出《通用规范汉字表》标准繁体字形。

开放可定制

Github 上全部字表、词典以 txt 格式发布,可自行编辑或编译为 ocd2;Apache 2.0 协议,自由用于任何项目。

卷 三

四种转换方案

四种 OpenCC 配置,覆盖繁⇄简与新旧字形的全部场景;均适用于 OpenCC 1.3.2 及以上版本。

主打方案

繁体 → 规范繁体

t2gov.json

针对内地繁体稿件与古籍整理稿件:转换全部异体关系,同时处理简—繁「一对一」字,解决繁简混杂问题。

精校模式

仅旧字形 → 新字形

t2new.json

只转换《新旧字形对照表》所收旧印刷字形及少量古籍讹字,保留大部分异体字,适合古诗文集等需人工判断的稿件。

反向转换

繁体 → 简体

t2s.json

将繁体字、异体字转为《通用规范汉字表》所收简体字;剔除了原 OpenCC 字表中大部分表外类推简化字。

简体适用

简体 → 规范繁体

s2t.json

依《通用规范汉字表》附件 1 将简体转为规范繁体;类推简化字原则上不予收录,留待出版人员三审三校处理。

卷 四

设计理念

以《通用规范汉字表》为纲,以《现代汉语词典》《辞海》等权威辞书为目——既尊规范,又校实事。

本表的编制是为了指导正确使用《通用规范汉字表》、方便古籍阅读、促进海峡两岸及港澳地区交流。
—— 《通用规范汉字表》附件 1《规范字与繁体字、异体字对照表》说明

规范繁体字 目标字形

《通用规范汉字表》附件 1 指定的繁体字形,以及一、二、三级字表中繁简一致的规范字。

异体字 原则停用

与规范字字音、字义相同而字形不同的字,为《通用规范汉字表》附件 1 指定的异体字形,原则上应当停止使用。

表外异体字 广收博采

《现汉》《新华字典》标识的表外异体字、《新旧字形对照表》旧字形、古籍中公认可径改的俗字讹字,均在收录之列——远超附件 1 的不足千组对应关系。

类推简化字 谨慎从严

《通用规范汉字表》之外的类推简化字原则上不再使用,本方案仅采纳权威辞书已收的少量字形。

收录与排除原则

凡有下列情形之一的,一律不予采纳
  1. 义项无法覆盖——异体字部分常用义项不能为规范字所覆盖,径改将致文本错误者,如「椷 → 缄」。
  2. 一对多异体关系——如「閒」兼为「闲」「间」之异体,「彊」兼为「强」「疆」之异体,不作单一映射。
  3. 辞书已立条目——《辞海》《现代汉语词典》已采纳为规范字形、拥有独立词条者,如菑、紬、並。
  4. 词语依《现汉》——具体词语用字以《现代汉语词典》(第 7 版)为准修订词库,如「面嚮講臺」,不采纳「面向講臺」。
⚠ 本方案在异体—正字关系上依据辞书对《通规》作了调整,不能视为与《通用规范汉字表》完全一致;出版从业者请将其作为便利工具,而非三审、校对依据。
卷 五

更新日志

自 2025 年 11 月首发以来持续迭代,逐版精修。

Version 1.4.02026-07-31最新版本
  • 修正强制编码设置影响字幕文件转换的问题
  • 改进 EPUB 转换支持,移除 ebooklib 依赖
  • 独立 AI 繁简转换模块更新至 0.2.4
Version 1.3.122026-07-26
  • 新增独立 AI 繁简转换模块(LLMCC,源码另行开源)
Version 1.3.112026-07-13
  • OpenCC 引擎更新至 1.4.1,跟随官方词库调整黄粱、高粱、小丑等词组转换
Version 1.3.92026-07-04
  • 删去 32 组非《通规》正字转换关系;OpenCC 引擎更新至 1.4.0
  • Linux deb 包针对 Deepin / GXDE 构建
Version 1.3.82026-07-02
  • 异体字转换关系新增 378 组,非《通规》正字原则上不再转换
  • Windows 7 兼容版本迁移至 OpenCC Python 替代实现
Version 1.3.62026-05-31
  • 新增 EPUB 电子书文件转换支持
Version 1.3.02026-04-05
  • 新增文本编码强制指定、结巴分词开关,解锁 Word 保留格式选项
Version 1.0.02025-11-23
  • 「规范繁体字形转换器」首次发布
卷 六

开始使用

三步即可上手;亦可从源码自行部署,或将方案接入自己的工具链。

下载安装包

点击下载 Windows 10/11 安装包 Windows 7 安装包 ,以及 Deepin / GXDE 系统的安装包。若下载慢或无法访问,请尝试从 Gitee 镜像站点 下载。

选择文件与转换模式

拖入 Word / TXT / EPUB / 字幕文件,选择「繁体→规范繁体」等四种模式之一,可按需开启结巴分词。

一键转换,校对成稿

转换结果按原格式输出;出版稿件建议再行人工三审三校。

从源码部署和自定义开发

git clone 仓库后进入 transformer(Windows)或 transformer-linux 目录,安装依赖并拷贝 t2gov 方案即可运行。

采用本方案的开源项目

字表与方案已被下列项目集成使用
opencc-wasm(WebAssembly 版 OpenCC)FranksLin OpenCC File Converter 简繁通转换大师TerryTian-tech regexp-replace-lists-for-TextProHuang Fusyong telegram-zh-Hant-CNSoizoKtantas Mainland Traditional Chinese ConverterXebec33
繁简转换交流 QQ 群

欢迎出版从业者与爱好者加入讨论

1055649831