
中国境内首个藏语大语言模型DeepZang启动新一轮升级,研发团队将重点提升藏语人工智能(AI)技术,并推进多语种同声传译功能,推动模型应用于公共服务、教育、医疗和基层治理等领域。
据中新社星期一(10月5日)报道,DeepZang升级迭代及同声传译研发推进会在内蒙古呼和浩特举行,科研机构、高校和企业代表围绕藏语AI技术优化、低资源语言模型训练和多语种同声传译等议题展开讨论。
藏语由于语言结构特殊、方言差异较大,以及高质量数字语料相对有限,一直属于自然语言处理领域的低资源语言。DeepZang研发团队称,模型已在多方言适配、语义识别和离线应用等方面持续改进,推动藏语智能技术从“基本可用”向“精准好用”跨越式升级。
根据此前公布的信息,DeepZang使用近7000万条藏语文本,以及超过3万零500小时、涵盖藏语三大方言的音频资料进行训练,可提供藏文、中文和英文的AI对话、实时翻译和语音转文字等功能。
会议提出,下一步将推动DeepZang深度融入公共服务、教育医疗、文旅发展、基层治理等场景,同时依托数字技术守护藏语方言资源,赋能藏族优秀传统文化数字化传承。
DeepZang创始人旦增罗布说,中国其他少数民族语言的AI开发也面对类似的低资源问题,因此跨区域、跨语种协同研发意义重大。他说,团队将持续深耕藏语AI技术迭代与示范应用,依托科技创新助力各民族交往交流交融。
香港《南华早报》指出,在DeepZang之前,位于印度达兰萨拉的非营利机构Monlam Tibetan IT Research Centre已推出藏语大语言模型Monlam AI。
报道分析,西藏事务一直是北京民族和宗教工作的重点。中国近年来持续加强国内藏学研究,尝试提升在西藏议题上的国际话语权。DeepZang也是这一整体布局的一环,即通过自身的数据和技术体系,塑造有关西藏的国际叙事。