当年多国嫌弃汉字难学主动放弃,到AI时代,才看清文字改革的真实代价
很多人会笼统说越南、韩国、日本都废除汉字。这个表述并不准确。日本从来没有废除汉字,只是持续规范汉字使用范围。
越南彻底改用拉丁国语字,扫盲速度确实提升,延续两千年的汉文文脉随之断裂。当代大部分越南年轻人,无法直接读懂本国留存的古籍典章。
1945年越南独立后,将国语字定为唯一法定文字,汉字退出官方体系。等到1975年南北统一,汉字教育在全国学校全面取消。这套拉丁文字上手门槛低,国民识字率快速上涨。
代价同样突出。国内留存海量汉喃典籍、碑刻、族谱,如今只有年长学者与老人能够顺畅阅读。普通年轻人面对祖先留下的文字记录,和阅读外文没有区别。不少家族族谱,后辈已经无法自主辨认。文字更换,直接切断普通民众接触本土古代文献的通道。
韩国走的是另一条路径。上世纪70年代,朴正熙政府推行谚文专用政策,小学阶段基本取消汉字教学。这项举措满足当时的民族文化诉求,表音文字书写简单,普及难度低。
同音歧义的问题很快暴露。韩语六成以上词汇源自汉字,同一个谚文拼写,会对应多个含义。京釜高铁二期施工阶段就出现过真实事故,图纸谚文“방수”,既可译作防水,也可译作放水。施工人员仅凭谚文判断,选用吸水材料,造成十余万根混凝土轨枕报废,产生巨额工程损失。
人工智能技术正呈现爆发式增长,这个旧矛盾被进一步放大。世界汉字学会河永三在公开访谈中提到,汉字属于高度凝练的信息系统,字形自带语义信息,对人工智能理解语言、区分歧义有重要参考价值。
基础教育阶段压缩汉字学习之后,韩国社会只能重新审视汉字的实用价值,学界与民间持续呼吁增加中小学汉字教学,弥补表音文字的先天短板。
日本保留汉字体系,2010年修订新版常用汉字表,总字数扩充至2136个。保留汉字不是单纯固守传统,而是利用汉字表意特性,作为语言消歧工具,给人工智能语料处理预留空间。
东亚这几个国家当年推进文字改革,出发点各有不同。有的是为脱离旧文化体系,有的是为快速普及基础教育。彼时普遍认为汉字学习负担重,想要简化文字。
几十年时间过去,各类隐性问题不断显现。文字的取舍,不能只盯着短期扫盲效率这一项指标。
韩国年轻人想要研读本国古代史料,需要额外补习汉字。原本可以直接阅读的文献,现在要重新补课,无形中增加学习成本。
文字体系改动,执行起来并不复杂。想要把丢失的文化载体重新捡回来,难度极大。人工智能时代,语言底层结构,直接决定信息识别、理解的效率。曾经被视作学习负担的汉字,在新的技术环境下,展现出独有的信息优势。
文化传承这件事,取舍之间,往往要跨越很长时间,才能看清全部代价。

