12月23日,由中央网信办、公安部联合指导厦门市政府主办的 [ 2020中国人工智能大赛成果发布会 ] 在厦门正式落幕。国音智能SpeakIn首席科学家许敏强博士率领的算法研发团队,成功斩获音频深度鉴伪赛道冠军,再次证明了国音智能业界领先的AI技术水平。
人工智能大赛颁奖现场
参赛团队代表现场留影
2020年中国人工智能大赛于9月17日正式启动,此次大赛以“融新汇智,竞促发展”为主题,吸引了来自国家电网、阿里等行业知名企业,以及中科大、西安交大等高校的200余支竞赛团队,可谓大咖云集。
本届大赛赛题设计紧跟国际前沿热点和现实场景难点,包含音频深度鉴伪、视频深度鉴伪、变种同源音频检索、特定行为识别、复杂场景文本识别5个赛题。
国音智能作为人工智能行业优秀企业,一直深耕音频深度鉴伪领域的技术研究。此次比赛采用“基于深度学习的音频鉴伪算法”报名参加音频深度鉴伪赛道,经过一个多月激烈角逐,最终夺冠,荣获B级证书。
国音智能荣获音频深度伪造检测B级证书
音频伪造事件泛滥,
鉴伪技术成为多行业刚需
随着计算机相关技术的进步与发展,多媒体编辑软件功能越来越强大,带来便利的同时,也使音频文件的安全性遭受到一定威胁,让不法分子有机可趁。他们可以通过TTS语音合成、恶意人声转换等操作,伪造数字音频证据,应用于法庭录音举证、民事纠纷处理、大众传播媒介发布及机密文件鉴定等重要场合,引起诸多不良社会问题。2019年《网络音视频信息管理规定》明确指出,禁止任何组织和个人滥用AI技术制作发布传播虚假新闻信息。在这种现实的需求下,音频鉴伪技术应运而生。
常见音频伪造技术手段
国音基于国际先进的深度学习技术,运用多种TTS语音合成以及VC语音转换技术生成海量伪造数据,利用MFCC和FBANK声学特征融合技术所提取的最优特征,对自研ResNet深度残差网络结构进行训练,最终获得高精度音频鉴伪算法模型。在本次比赛测试集中,国音智能自主研发的音频鉴伪算法模型在所有参赛团队中效果最好,获得第一名。
未来,国音智能将继续加强音频鉴伪领域技术研究,不断优化已有的算法模型和研发新型神经网络模型。除此之外,国音智能正在探索视频鉴伪领域,计划将人脸鉴伪模型和水印编解码模型技术融合,提供一套包含鉴伪、溯源的全面AI视频识别服务,进一步提升AI视频生态安全性。
优秀的技术,出自精英的团队
国音智能参赛团队
此次参赛团队是由国音智能首席科学家许敏强博士率领的算法团队组成,成员均来自于国内外知名高校。作为团队核心领导者,许博有着深厚的学术背景和行业经验。身为中国科技大学博士、伊利诺伊大学香槟分校(UIUC)联培博士,他曾就职于微软亚洲研究院、盛大创新院、阿里巴巴、百度,担任语音、声纹算法部门负责人。近几年,他带领国音算法研发团队深入探索和优化深度神经网络结构,多次率领团队在全球最大的开源说话人数据集Voxceleb和NIST说话人识别比赛上取得突破性成绩。
国音立足AI, 助力城市数字化转型
国音智能自成立以来,始终秉承“帮助城市设施与机器更好地服务于人”的使命,汇聚行业内优秀人才,不断提升自主算法研发能力、产品落地能力,逐渐备齐各项AI能力,为各行业提供完善的生物识别系统安全解决方案。
在未来的走向里,让我们期待国音智能用AI之光点亮全行业。

