承续语料库传统,回应智能时代新题:生成式人工智能时代的语料库语言学研讨会成功举办
2026/08/13
2026年8月9日至11日,生成式人工智能时代的语料库语言学研讨会(Symposium on Corpus Linguistics in the Age of Generative AI)成功举办。本届研讨会由中国英汉语比较研究会语料库语言学专业委员会和北京外国语大学中国外语与教育研究中心联合主办、外语教学与研究出版社承办、《语料库语言学》杂志协办。来自海内外的190余位专家学者齐聚北京,以“生成式人工智能时代的语料库语言学”为主题,共同研讨大语言模型飞速发展背景下,语料库语言学的前沿理论与实践问题。8月9日晚,中国英汉语比较研究会语料库语言学专业委员会召开了理事会会议。

开幕致辞追溯学术传统
直面智能时代新题
研讨会开幕式上,中国英汉语比较研究会语料库语言学专业委员会创会主任委员卫乃兴教授、名誉主任委员梁茂成教授作为特邀嘉宾先后致辞。
卫乃兴教授在致辞中回顾了中国语料库语言学的发展历程,提到以杨惠中教授为代表的中国第一代语料库学人留下了宝贵的学术品格和精神遗产,并从三个方面与参会学者共勉:一是求真至臻的学术准则。早期JDEST语料库建设服务于国家新一代大学英语教学大纲词表研制,体现了面向真实问题的研究取向;二是迎难而上的攻坚精神。在当时技术条件有限的情况下,学界仍建成了具有国际影响的语料库资源;三是百折不挠的坚定毅力。卫教授回忆,1993年国内第一届语料库语言学研讨会发言者仅15人左右,几十年之后的今天,曾处于少数派位置的语料库语言学已经获得了蓬勃发展。他勉励学者们在认定有价值的研究方向后,要沉下心来,坚持长期主义。

中国英汉语比较研究会语料库语言学专业
委员会创会主任委员 卫乃兴教授
梁茂成教授在致辞中指出,语料库的立身之本在于语言文本的真实性。在生成式人工智能大量生成文本的当下,研究者从网络等渠道获取的语料中,哪些真正源于人类交际,哪些可能已受到机器生成文本的影响,已成为语料库语言学研究必须正视的重要问题。梁教授最后感谢会务团队的组织工作,并预祝会议顺利举行。

中国英汉语比较研究会语料库语言学专业委员会
名誉主任委员 梁茂成教授

北京外国语大学 许家金教授
开幕式由北京外国语大学许家金教授主持。
主旨发言回应智能浪潮
前沿研究引领方向
8月10日上午,卫乃兴、梁茂成、邓耀臣、雷蕾四位教授分别作了大会主旨发言。四场报告虽切入点不同,但均聚焦于人工智能时代语料库语言学的范式转型与路径探索,既有理论层面的省思,亦有工具开发与实证研究的突破。
北京航空航天大学卫乃兴教授梳理了人工智能与语料库语言学在研究理念、技术路径和方法论上的关联与分野。卫教授指出,当前语料库语言学研究仍应立足大规模的真实语言数据,并从最小化先验假设和加强跨领域验证等方面,探索人工智能辅助语料库驱动语言学的新路径。交流环节中,许家金教授等学者围绕语言使用与语言系统的关系及自下而上的理论抽象等问题与卫教授展开讨论。

北京航空航天大学 卫乃兴教授
北京航空航天大学梁茂成教授指出任务与人设的匹配程度是影响提示词质量的关键因素之一,并展示了团队开发的PromptMaster工具。该工具可根据任务所需知识结构自动推导人设,生成候选提示词,为提示词设计与优化提供支持。与会学者围绕人设与大模型自身生成风格的关系向梁教授提问,并就翻译任务中提示词对译文风格的影响展开讨论。

北京航空航天大学 梁茂成教授
大连外国语大学邓耀臣教授指出大语言模型具有出色的上下文语义捕获能力,在术语自动抽取任务中具有性能优势。报告系统考察了模型架构、参数规模和提示词设计对抽取效率的影响,并讨论了不同模型的领域适应性及幻觉问题的应对策略。交流环节中,与会学者围绕大语言模型快速迭代背景下术语自动抽取的时效性展开讨论。

大连外国语大学 邓耀臣教授
上海外国语大学雷蕾教授探讨了人工智能对当下语料库语言学研究的重塑作用,指出人工智能可为研究全过程提供支持,但研究者的语言直觉与专业知识仍不可替代。随后,雷教授围绕复杂度权衡假设,以跨越2000年的汉语书面语词汇与句法变化为例,展示了相关研究成果。交流环节中,北京语言大学饶高琦副研究员就口语与书面语等不同媒介中的复杂度权衡差异与雷教授展开讨论。

上海外国语大学 雷蕾教授
上述主旨发言分别由北京航空航天大学董敏教授、华中科技大学潘璠教授、河南师范大学娄宝翠教授和上海交通大学甄凤超教授主持。

北京航空航天大学 董敏教授

华中科技大学 潘璠教授

河南师范大学 娄宝翠教授

上海交通大学 甄凤超教授
8月11日上午,原伟、苏杭、饶高琦、刘鼎甲四位学者作大会主旨发言。四场报告共同指向一个核心关切——当大语言模型从研究工具跃升为研究对象,语料库语言学如何在方法上作出调适、在边界上实现拓展。从流程标准化到言语行为评估,再到语言生活重构与跨模态意义建构,四位学者分别从不同环节回应了这一时代命题。
国防科技大学原伟教授从多语种文体计量、大模型语用识别和网络失序信息判别等研究切入,探讨如何科学、合理、稳定地使用大语言模型解决具体研究问题,并提出应将大语言模型生成过程转化为可复现、可检验的标准化标注流程。交流环节中,与会代围绕语料库建库代表性及其对虚假新闻研究结论的影响与原教授展开讨论。

国防科技大学 原伟教授
上海外国语大学苏杭教授从局部语法路径出发,评估大语言模型的言语行为能力。报告以道歉言语行为为例,探讨大模型生成的道歉在多大程度上接近人类道歉,并推动相关研究从“能否实施”进一步走向“如何实施、是否得体实施”的机制层面。交流环节中,李文超教授就如何借助局部语法路径引导大语言模型输出更符合人类交际习惯的言语行为与苏教授展开讨论。

上海外国语大学 苏杭教授
北京语言大学饶高琦副研究员关注数智时代语言生活的新变化,提出大语言模型在语言生活中兼具资源、主体和媒介三重角色,提示语料库研究者关注人机共生语境下不断生成的新语言现象。交流环节中,许家金教授就如何理解语言生活的真实性与饶副研究员展开讨论。

北京语言大学 饶高琦副研究员
北京外国语大学刘鼎甲副教授以药品包装正面为对象,介绍了大语言模型辅助下跨模态图文意义建构的量化研究。研究构建了涵盖中国、美国、欧洲和日本四个市场、四类非处方药的多模态语料库,分析图像与文字的协同构义。交流环节中,陆军教授和饶高琦副研究员分别就颜色意义及市场监管要求对包装图文配置的影响展开讨论。

北京外国语大学 刘鼎甲副教授
上述主旨发言分别由北京师范大学王德亮教授、浙江大学李文超教授、广东外语外贸大学胡春雨教授和扬州大学陆军教授主持。

北京师范大学 王德亮教授

浙江大学 李文超教授

广东外语外贸大学 胡春雨教授

扬州大学 陆军教授
分论坛展开多元讨论
会场内外共研新知
除主旨发言外,本次研讨会于8月10日下午设置了十个分论坛,共安排124场分组发言。各分论坛既关注生成式人工智能在语料建设、标注、检索和分析流程中的应用,也回应语言教学、翻译研究、学术语篇、智能传播与数字人文等具体研究场景。长春师范大学邹艳丽教授、安徽工程大学刘运锋副教授、浙江财经大学熊建国副教授、浙江大学李文超教授、河南师范大学孙海燕教授、对外经济贸易大学陈功教授、上海师范大学王丽教授、北京外国语大学孔蕾教授、曲阜师范大学张超教授、北京航空航天大学徐昉教授、上海交通大学林玲副教授、北京航空航天大学姜峰教授、北京航空航天大学张懂副教授、浙江工商大学钱毓芳教授、北京航空航天大学金碧希副教授、华南农业大学邓飞教授、浙江工商大学杨娜教授、北京师范大学王德亮教授和烟台大学杨林伟教授等专家主持了分论坛并对发言逐一点评,与会代表们讨论热烈,交流充分。










十个分论坛现场
分论坛结束后,学术交流延续至会场之外。在酒店大堂,参会教师和学生围绕当天主旨发言与分论坛报告继续展开讨论,主旨发言及语料库语言学专业委员会多位专家也参与其中,就研究问题、方法路径和学科发展等话题深入交流,现场气氛热烈。
闭幕总结凝聚共识
学术交流持续拓展
在研讨会闭幕式上,中国英汉语比较研究会语料库语言学专业委员会总干事刘国兵教授作大会总结发言,从学术贡献、会议组织与学科生态三个层面,对本次研讨会进行了全面回顾与精要概括。刘教授在总结中梳理了本次研讨会的核心议题与主要成果,肯定了本次研讨会在推动生成式人工智能与语料库语言学融合发展方面的积极作用。刘国兵教授特别指出,本次会议为学界搭建了高水平、专业性的交流平台,使个体思考得以汇入集体对话,积极鼓励硕博士研究生参会并给予专家点评的方式,也为学术会议组织和研究梯队培养提供了新的思路。最后,刘国兵教授代表学会对会议组织者、全体专家、所有与会代表和志愿者表示诚挚感谢。研讨会闭幕式由北京外国语大学黄鼎博士主持。

中国英汉语比较研究会语料库语言学专业委员会总干事
刘国兵教授

北京外国语大学 黄鼎博士

生成式人工智能时代的语料库语言学研讨会
全体参会人员合影
更多信息请访问本次会议的官方网站:
https://corpus.bfsu.edu.cn/CLOC2026.html