专题演讲嘉宾:张鑫

微软亚洲研究院研发工程师

MSRA 研发工程师,NNI 项目参与者。

by 张鑫

微软亚洲研究院
研发工程师

大规模预训练模型当前在人工智能领域扮演着重要的角色,其极大地推动了各领域的发展。而在实际部署应用中,其庞大的参数量和运算量对服务端的软硬件资源带来了极大的挑战。因此,模型压缩成为模型部署前的重要环节。由于模型压缩技术和算法的多样性且涉及模型推理延迟的编译优化,整个模型压缩的流程繁琐而复杂。本次演讲将主要介绍NNI在模型压缩上的探索与实践,通过统一的框架融合模型压缩的多种技术与方法,打通从模型压缩到模型加速的整个流程。在Transformer系列预训练模型的压缩实践中,探索出一套行之有效的压缩方法与流程,在保持高精度的同时,大幅度降低参数量与推理延迟。
 

交通指南

北京·四季酒店

Beijing International Convention Center
地址:北京市朝阳区亮马桥路48号
  • 微信咨询

  • 电话咨询

    联系电话:+86 15600537884

微信联系我们

小姐姐