跳转到内容
← AI 人物志
基础与架构

孙茂松

Maosong Sun

中文 NLP · 预训练模型

孙茂松是自然语言处理研究者,长期从事中文语言计算、语义分析及语言资源建设。他的研究经历覆盖从传统 NLP 到大规模预训练模型的多个阶段。

中文处理涉及分词、句法、语义与知识组织,也需要长期积累的数据资源和评价条件。他与合作者参与语言表示和预训练模型研究,推动中文任务使用更通用的模型与工具。

在 CPM 等合作工作中,研究团队探索大规模中文预训练与文本生成:先用大量中文文本训练通用模型,再利用任务描述或少量示例完成下游任务。这与早期为每个语言任务分别设计系统的方式形成了鲜明对照。