
主讲人:
詹卫东 北京大学中文系教授
主讲人简介:
詹卫东,北京大学中文系教授。主要研究领域为现代汉语形式语法、中文信息处理、语言知识工程、语言文字规范等。代表性成果包括专著《面向中文信息处理的现代汉语短语结构规则研究》,国家语言文字标准《出版物上数字用法》及配套读本《〈出版物上数字用法〉解读》。参编《计算语言学概论》《自然语言处理》《现代汉语》等多部教材。近年来,其研究主要聚焦在现代汉语构式资源库建设,面向认知智能的机器语言理解能力评测。
内容摘要:
本讲座从“知识”与“数据”的关系出发,讨论人工智能特别是大语言模型蓬勃发展的当下,计算语言学所面临的角色变化与任务调整。传统计算语言学的侧重于分析具体语言事实,提炼语言形式、意义和使用条件之间的系统知识,并加以形式化,以提供计算应用;而当代人工智能则主要依靠大规模数据和计算模型,实现对语言规律的统计、学习与生成。二者的差异表明,语言学的价值不仅在于提出解释性理论,更在于能否将语言分析所得转化为可生成、可检验、可扩展的数据资源。人工智能的发展,实际上对语言学提出了新的要求:语言学既要产出语言理论知识,也要提升处理语言数据的能力,包括数据生成、组织与实际应用。讲座围绕语言学知识如何深度融入训练语料构造、任务设计和能力评测等环节展开讲述,并进一步思考人工智能时代语言学知识生产方式的转型及其学术意义。
主办单位:
国家图书馆
讲座时间和地点:
2026/07/08 14:00-16:00 国家典籍博物馆(北京市海淀区中关村南大街33号)2层启德厅

信息来源:国家图书馆