藏语人工智能正在被直接接入中国的基层治理体系。10月7日公开的信息显示,中国境内首个藏语大语言模型DeepZang启动新一轮升级,研发团队计划把它进一步部署到公共服务、教育、医疗、文旅和基层治理,同时把技术目标与“各民族交往交流交融”绑定。

一项语言技术,被赋予治理任务

DeepZang公开宣传页面显示其定位为藏语AI助手|来源:Apple App Store / MWM
DeepZang公开宣传页面显示其定位为藏语AI助手|来源:Apple App Store / MWM · 查看图片来源 ↗

DeepZang今年3月在拉萨发布。公开资料显示,该模型使用近7000万条藏语文本和超过3万零500小时、覆盖三大藏语方言的语音资料训练,可进行藏文、中文和英文问答、翻译及语音转写。单从技术层面看,这确实补上了低资源语言长期缺乏数字工具的一块空白。

但本轮升级透露出的信息,不只是模型能力提高。10月5日在呼和浩特举行的推进会上,研发方明确提出要把模型用于基层治理,并以技术创新“促进各民族交往交流交融”。这使DeepZang从语言工具进入国家民族治理体系。

原始来源 · zaobao.com.sg中国藏语大模型DeepZang升级 融入基层治理等场景zaobao.com.sg ↗

谁定义藏语在数字空间里怎样被使用

DeepZang今年3月发布时的应用界面资料图|来源:联合早报
DeepZang今年3月发布时的应用界面资料图|来源:联合早报 · 查看图片来源 ↗

藏语AI当然可能帮助使用者跨越数字鸿沟,特别是在医疗、教育和公共服务中。但一个关键问题随之出现:模型由谁训练、使用什么语料、哪些政治与历史词汇会被过滤、不同藏区方言如何被标准化,以及用户通过AI获得的西藏历史和宗教信息将遵循什么叙事。

中国国家民族事务委员会今年2月公布DeepZang通过国家互联网信息办公室深度合成服务算法备案时,特别写明其集成“内容安全过滤与溯源机制”。这意味着该模型从诞生之初就不是一个脱离中国审查制度运行的独立语言工具。

原始来源 · neac.gov.cn我国首个藏语生成式AI算法通过国家备案neac.gov.cn ↗

当这种模型进一步嵌入学校、政务和基层治理,它就不仅回答“怎样翻译”,也可能影响“什么能够被说”“什么是标准表达”“什么历史解释被允许进入公共服务系统”。

保护语言与管理语言,是两件不同的事

官方材料强调DeepZang能够保存三大方言、推动藏族传统文化数字化,这部分技术价值不应被忽略。对一种在数字资源中长期处于弱势的语言来说,建立大规模语料、语音数据库和机器翻译能力,本身具有现实意义。

问题在于,语言保存与政治整合并不天然是一回事。北京近年来在西藏持续强化国家通用语言教育、宗教事务管理和“中华民族共同体”叙事。现在,AI被加入这一体系后,技术可以把统一术语、政策口径和信息过滤更深地带进日常使用场景。

这也是为什么DeepZang值得被当作社会治理新闻,而不是一条普通科技新闻来看。它把过去主要依靠学校教材、行政文件和宣传媒体完成的语言治理,推进到算法层面。

算法开始进入民族政策最细的末端

当一个藏语模型同时承担翻译助手、教育工具、政务入口和基层治理接口时,算法会逐渐成为人与政府之间的中介。模型训练数据和安全规则因此不再只是企业技术细节,而成为公共权力的一部分。

真正决定DeepZang意义的,不是它能不能说流利藏语,而是藏语使用者能否在这个系统中保有表达、记忆、宗教与历史叙事的自主空间。如果技术只能让藏语更高效地承载官方允许的内容,那么数字化保存语言的同时,也可能完成对语言意义空间的重新编码。

RELATED ENTITIES

相关实体关系

机构
MEMBER DISCUSSION

文章讨论

已验证会员可围绕报道公开交流,并自行管理自己的内容。