郑茂,腾讯混元技术专家,混元应用算法负责人。
硕士毕业于哈尔滨工业大学,现任腾讯混元技术专家,混元应用算法负责人。负责混元大模型在腾讯的应用落地,支持广告、社交、娱乐、教育、客服等业务的大模型应用层效果优化。技术研究方向包括大模型复杂推理、多轮对话、翻译、RAG、AGENT 等。在 ACL、AAAI、EMNLP、COLING、CVPR 等会议上发表数十篇论文。带领团队获得 WMT 翻译比赛诸多赛道第一名。
腾讯混元开源其国际翻译比赛冠军模型 Hunyuan-MT-7B,该模型参数量为 70 亿,支持 33 种语言和 5 种民汉语言/方言互译,是一个轻量级但能力全面的翻译模型。同时开源的还有业界首个翻译集成模型 Hunyuan-MT-Chimera-7B,它可综合多个翻译模型的结果生成更优翻译,支持接入包括 Deepseek 在内的其他模型。开源不到一周的时间,混元翻译模型登顶 Hugging Face 模型趋势榜第一位。
在 ACL WMT2025 比赛中,Hunyuan-MT-7B 在 31 个语种中获 30 项第一,涵盖常见语种及多个小语种。Hunyuan-MT-7B 在参数受限情况下击败了多个更大规模的模型。在 Flores200 测评数据集上,其表现也领先同规模模型,媲美更大模型。
该模型采用的训练范式涵盖预训练、监督调参、翻译强化等环节。其轻量设计带来多项优势:推理速度更快、支持 FP8 量化进一步提升性能 30%,部署灵活且成本更低,适用于从服务器到边缘设备的多种环境。目前该模型已应用于腾讯会议、企业微信、QQ 浏览器等业务。
本次演讲我将主要介绍腾讯混元大模型团队在混元翻译模型上的训练优化方法。提出大模型翻译能力训练范式,分享在业务应用中的优化经验,希望能给大家带来一些帮助。
演讲提纲
1. 大模型时代机器翻译面临的挑战
2. 大模型机器翻译能力构建
3. 业务应用中遇到的困难
4. 总结与展望
您认为,这样的技术在实践过程中有哪些痛点?
演讲亮点
听众收益



微信咨询

电话咨询
微信联系我们

