如果说传统印象中的语言学更多与词典、语法和古籍相联系,那么,8月27日,中国社会科学院(中国社会科学院大学)语言学重点实验室发布的成果则呈现出另一幅图景:西夏文进入人工智能的计算空间,儿童的普通话发音可以获得智能诊断,老年人的声音成为适老化技术的重要数据基础,超声设备能够动态观察说话时舌头的运动,而一项关于声调学习的实验则把语言研究延伸到睡眠与记忆的奥秘之中。5项研究成果以真实语言为材料,以实验方法和数字智能技术为手段,探索语言的基本规律,回应文化传承、教育发展、人口老龄化和人工智能时代的现实需求。

■“中国社会科学院多文种数智平台之西夏文平台”汇聚的多国馆藏典籍资源
让西夏文进入数字世界
作为中华文明多元一体格局形成和发展的重要见证,西夏文献保存着丰富的语言、历史、宗教和社会生活信息。然而,西夏文字形复杂、文献资料分散,大量材料以图像形式保存,传统研究往往需要在原始文献、释读成果和研究著作之间反复查找、比对。
张永伟团队建设的“中国社会科学院多文种数智平台之西夏文平台”尝试改变这一传统研究格局。作为全球首个西夏文数智化平台,其系统整合了公开的西夏文典籍和研究文献,建设多层次标注语料库,将长期积累的专家知识转化为规范化、结构化、可计算的数据资源。研究者既可以通过西夏字形、拟音或汉语释义检索,也可以进一步追溯原始文献图像,实现“以文查图、以图证文、图文互证”。
平台还支持光学字符识别、自动翻译和残缺文献智能补全等功能,建立公开的智能评测基准。其中,西夏文印刷体识别准确率达到98.23%,文献录入和初步加工效率较传统人工方式提高5倍以上。人工智能的作用并非取代学者,而是承担部分重复性工作,使研究人员能够投入到文字考释、文献校勘和历史文化阐释等工作之中。
这一成果的意义还在于为冷门绝学研究探索出新的传承方式。通过数智化建设,原本分散的资料和依赖个体长期积累的专家知识,可以逐步转化为可共享、可检索、可持续积累的学术基础设施。作为“中国社会科学院冷门绝学数智化研究矩阵”的示范工程,西夏文数智化平台也为其他古文字、民族文字和珍稀文献的数字化保护与智能研究提供了新的思路。
让人工智能听懂孩子的发音
0—6岁是儿童语言发展的关键时期,对于学前儿童来说,发音是否准确关系其语言能力的发展。科学测评儿童发音,有助于及时发现其语言发展中的问题,实现早筛查、早发现、早干预。对于民族地区儿童而言,相关测评还能够为国家通用语言学习提供科学支持。
传统儿童发音测评主要依赖专业人员的经验和判断,效率较低,难以满足大规模、常态化测评的需求,而成人语音模型又难以直接用于儿童发音分析。高军团队研发的“中国学前儿童普通话发音智能测评系统”针对这一问题提供了智能化解决方案。该系统依托自主研发的科学发音测试量表和专业儿童语音大数据,采用儿童“看图说词”等适合其年龄特点的测试方式,自动识别普通话声母、韵母和声调的具体发音错误,并生成测评结果。
这套系统不仅回答了儿童“发音是否正确”,还进一步分析了“错误在哪里”,并根据不同儿童的测评结果智能推送由专家编制的个性化分级练习内容,形成从测评、诊断到练习的完整路径。团队利用22万条学前儿童普通话数据和1.2万条维吾尔族学前儿童国家通用语言发音数据,训练形成儿童发音纠错专用模型。相关成果已经在新疆、北京、内蒙古等地开展试点应用,并入选《2025年国家关键领域语言科技赋能创新项目案例》。
从依赖人工经验到智能辅助测评,这项成果探索的是语言科学、儿童教育与人工智能的结合。技术的目标不是替代教师,而是为教师提供更加客观、精准和高效的工具,让有限的专业资源服务更多儿童。
为老年人的声音建立数据库
当语音助手和智能终端越来越融入日常生活,一个新的问题逐渐显现:人工智能是否真正听得懂老年人的声音?随着年龄增长,人的语速、响度、发音清晰度和表达方式都会发生变化。这些变化不仅影响日常交流,也影响老年人使用数字产品和参与数字社会的体验。然而,现有语音人工智能训练数据更多来自年轻群体,缺少能够系统反映不同年龄阶段语言特点的基础数据。
李倩团队建设的“成人语音老化数据库CASS-AGING”正是针对这一基础性问题展开。作为国内首款覆盖成年各年龄段的汉语综合语音库,数据库采集了约400名18—70岁成年人在多种任务条件下的语音数据,为研究语言老化机制和建设适老化人工智能模型提供了重要的数据基础。
数据库特别设置中青年“黄金对照组”,系统比较不同年龄阶段的语言特征;对50岁以上群体进行更细致的年龄划分,以观察语言衰老过程中的细微变化。同时,数据库既包含字、词、句等朗读任务,也包含自由话语任务,力求结合其听力水平和个人背景等信息,呈现更加接近真实生活的语言状态。
数据库既服务基础研究,也面向现实应用。它有助于描绘成年人语言特征随年龄变化的轨迹,探索语言老化机制;未来还可以促进语音交互系统优化,让数字技术更好地理解老年人的表达。从要求老年人适应技术,到推动技术主动适应老年人,其背后需要扎实的语言数据基础,CASS-AGING所建设的,正是一项面向老龄化社会的语言基础设施。
给舌头做“实时B超”
“前门到了,请从后门儿下车。”对于普通话母语者而言,这句话十分平常;但对于不少汉语学习者来说,其中的卷舌音和儿化音却是学习难点。陈树雯团队的研究从汉语卷舌音出发,尝试探索一个长期存在于语音学研究中的基本问题:人说话时,舌头究竟是怎样运动的?
声音可以被听到,但发音器官在口腔中的运动却难以直接观察。过去,研究者主要依据听辨和声学分析推测发音动作。陈树雯团队则将医学超声成像技术应用于语音研究。实验中,超声探头固定在受试者下颌下方,受试者发音时,舌头的动态运动过程可以被连续记录,并与声音信号进行对应分析,相当于给正在说话的舌头做一次“实时B超”。这种方法使研究者能够从发音的生理层面重新观察汉语语音。研究发现,同一个声音并不一定只有唯一的发音动作,不同的舌头运动方式可能产生相近的声音结果。这为理解复杂语音的形成、儿童如何习得发音动作,以及二语学习者如何掌握陌生语音提供了新的实验依据。
一个小小的卷舌音,连接着汉语语音系统、语言演变、母语习得和二语习得等多个问题。由于卷舌现象存在于世界多种语言中,汉语又呈现出丰富而独特的表现形式,这项研究还为世界语言的语音类型比较提供了实验材料。
从“听声音”到“看发音”,实验技术正在改变语音研究的方式,也为普通话教学、国际中文教育、言语康复以及智能语音技术提供更加精细的科学依据。
从声调学习追问睡眠是否巩固记忆
通常,人们认为睡眠有助于巩固记忆。但罗颖艺团队通过语言认知实验发现,睡眠与记忆之间的关系可能比人们想象得更加复杂。
研究从一个日常现象出发。当人们接触带有陌生口音的说话者时,起初可能觉得某些声音“不标准”,但经过一段时间接触后又会逐渐适应。罗颖艺团队以介于普通话一声和二声之间的模糊声调为材料,设计不同语言经验条件,观察参与者的声音类别,判断如何变化。
实验发现,短暂的语言经验确实能够改变听者的判断。即使面对训练中没有出现过的新词,参与者仍会表现出相应的声调类别变化。这说明,人们调整的可能不仅是对具体词语的记忆,还涉及更深层的声音类别判断。更值得关注的是,研究团队在约12小时后比较不同状态下的记忆变化,发现刚刚训练结束时较为明显的学习效应显著减弱,睡眠并没有表现出预期的记忆巩固优势。
这一结果提示,“睡眠促进记忆”并不适用于所有学习内容的简单规律。对于声调这类既承载语言信息,又容易受到说话人和语境影响的因素,人脑可能需要保持一定的灵活性:既能够迅速适应新的语言输入,同时又避免将短暂经验轻易固化。
从一个模糊声调出发,这项研究最终触及的是人脑如何在学习新信息与保持既有知识之间取得平衡。语言研究由此成为探索人类知觉和记忆机制的一个重要窗口。
以上这些成果分别回应着中华优秀传统文化传承、儿童语言发展、积极应对人口老龄化、人工智能技术创新和人类认知研究等不同领域的需求,代表着中国语言学研究的一种新趋势:从真实问题出发,以实验、数据和智能技术为支撑,在基础研究、交叉研究与社会应用之间建立更加紧密的联系。它们的共同价值在于,语言不再只是被静态描述和分析的对象,也成为连接文明记忆、人的成长、社会服务与未来技术的重要资源。
随着实验方法、数字技术和人工智能不断进入语言研究,中国语言学正在形成新的研究能力和新的社会连接。从实验室中的一次发音测试,到古籍中的一个文字;从儿童成长中的一个声音,到老年人在数字社会中的一次表达,语言科学正在以更加精确、更加开放、更加贴近现实的方式,回应时代提出的问题。
(中国社会科学院(中国社会科学院大学)语言学重点实验室/供稿、供图)