主要研究方向为大规模语言模型、信息抽取、自然语言理解以及文本生成。他在AI领域的一流学术会议和期刊上发表科研论文100多篇,被引用近6000次,H-index为39。他曾担任 EMNLP 2021和 CIKM 2013的系统展示主席,KDD2022 的资深程序委员会委员,以及 ACL、EMNLP、TheWebConf、AAAI 等会议的程序委员会委员。他和同事合作发表了第一篇利用深度学习技术解数学应用题的论文,是后续相关研究的必引论文之一。
除学术研究外,他在大规模语言模型、知识图谱、搜索、自然语言理解、智能写作、机器翻译等方面有丰富的系统开发和工程落地经验。
在腾讯AI Lab,他的团队主导构建的系统和开源数据包括文本理解系统 TexSmart、交互翻译系统 TranSmart、智能写作助手 Effidit、大规模中文词向量数据等。其中 TexSmart 获得第十九届中国计算语言学大会最佳系统展示奖,TranSmart 是国内首个公开的交互式机器翻译互联网落地产品。腾讯 AI Lab 在国际机器翻译大赛WMT2020到2022上共获得9项第一和8项第二。




