浙大硕士毕业后加入网易,先后参与网易 UU 网游加速器、易信、云信等项目。现任网易云信音视频技术负责人,全面负责实时音视频、流媒体 AI 处理、AI数字人、直播、点播、WE-CAN 全球传输网等项目的架构设计与研发。对音视频、AI 技术在流媒体的应用、高性能服务器以及网络传输等领域均有多年的工作与项目经验。

浙大硕士毕业后加入网易,先后参与网易 UU 网游加速器、易信、云信等项目。现任网易云信音视频技术负责人,全面负责实时音视频、流媒体 AI 处理、AI数字人、直播、点播、WE-CAN 全球传输网等项目的架构设计与研发。对音视频、AI 技术在流媒体的应用、高性能服务器以及网络传输等领域均有多年的工作与项目经验。
面对行业数据孤岛和交互低效的挑战,企业智能化升级亟需突破传统技术瓶颈。数据孤岛现象导致企业内部信息流通不畅,各部门数据难以整合,严重影响决策效率和业务协同。同时,现有交互系统响应迟缓,无法满足实时性需求,尤其在客户服务和智能交互场景中表现突出。
为解决这些问题,云信提出创新方案,融合声纹、情感、环境音等多维信号,结合大语言模型的动态微调能力,实现个性化对话理解。这种融合方式不仅提升了交互的自然度和准确性,还支持互动、打断和交互识别,显著改善用户体验。此外,通过“ LLM+ASR+TTS ”以及 LLM 实时交互的混合模式,企业能够快速部署符合自身场景的 AI 智能体。这种模式在教育 AI 口语教练、医疗问诊辅助、社交陪聊与助聊、AI 智能客服等多个场景中实现落地应用,展现了强大的跨模态数据协同能力。
本次分享我将深入解析这些技术背后的实现原理,探讨从语音对话到智能体对话的技术演进路径,并展望脑机接口、3D 空间音频等前沿技术的发展方向。
演讲提纲
1. 大模型带来对话交互变革
2. 技术引擎:大模型融合的对话式语音 AI 技术架构
3. 场景落地:跨行业应用实践与教训
4. 未来展望:多模态交互的无限可能
您认为,这样的技术在实践过程中有哪些痛点?
演讲亮点
听众收益



微信咨询

电话咨询
微信联系我们

