2020 年 4 月加入虎牙直播,从事智能审核有关工作,参与智能语音审核开发、娇喘音频事件检测开发与应用、和团队一起从 0 到 1 落地直播场景违规内容实时消音项目,专注于语音识别、音频事件检测等领域的研究与应用。

2020 年 4 月加入虎牙直播,从事智能审核有关工作,参与智能语音审核开发、娇喘音频事件检测开发与应用、和团队一起从 0 到 1 落地直播场景违规内容实时消音项目,专注于语音识别、音频事件检测等领域的研究与应用。
目前直播场景业界主要通过 AI+人工审核的方式,这是一种事后审查的处理方式,是对主播已发生违规行为后,再进行处罚,但违规的内容已经直播给观众,特别是大主播违规后,造成的影响更大,甚至导致主播遭到封禁,给平台造成损失。
音频流实时消音,是一种先审后发的技术,可以不增加直播延迟,利用客户端的播放缓存时间在客户端进行消音,实时屏蔽主播的违规音频,有效减少主播及平台的重大事故风险,实现先审后发。
本次分享将介绍我们团队如何利用流式语音识别、语音激活检测等技术构建低延迟的音频违规内容消音系统,并介绍工作中的一些挑战、思考以及解决方法,希望能给从事音频内容审核和语音识别领域的人员一些参考。
演讲提纲:
1. 实时消音介绍
2. 核心能力构建与优化
3. 落地效果及展望
你将获得:



微信咨询

电话咨询
微信联系我们

