声明
严正声明:本站非期刊官网,非中介代理。
本站仅提供学术规范服务:快速预审、润色编辑服务、中英文查重、降重、去重服务、推荐合适的期刊投稿等学术规范服务。 如需提供学术规范服务请联系在线编辑。
国内刊号:11-1777/TP
国际刊号:1000-1239
发布日期:
作者:王嘉凯,孔宇升,陈镇东,胡琎,尹子鑫,马宇晴,杨晴虹,刘祥龙,
关键词:人工智能安全, 对抗攻击, 音频识别, 物理攻击, 音素对抗噪声,
语音识别等智能技术在自动驾驶、物联网等场景下得到了广泛的应用.近年来,针对语音识别的对抗攻击研究逐渐受到关注.然而,现有的大多数研究主要依赖于粗粒度的音频特征来在实例级别生成对抗噪声,这导致生成时间成本高昂且攻击能力弱.考虑到所有语音可以被视为基本音素的不同组合,提出了一个基于音素的通用对抗攻击方法——音素对抗噪声(phonemicadversarialnoise,PAN),该方法通过攻击在音频数据中普遍存在的音素级别的细粒度音频特征,以生成音素级对抗噪声,取得了更快的对抗噪声生成速度并具备更强的通用攻击能力.为了全面地评估所提出的PAN框架,在实验中基于LibriSpeech等多种语音识别任务中被广泛采用的公开数据集,对提出的音素对抗噪声的攻击有效性、跨数据集的泛化能力、跨模型迁移攻击能力和跨任务迁移攻击能力进行了验证,并进一步在物理世界设备中证实了对民用智能音频识别应用的攻击效果.实验结果表明,所提出的方法比其他对比方法的攻击能力提高了38%,生成速度快了24倍以上,且提出的采样策略和学习方法对降低训练时间和提升攻击能力具有重要作用.
来源:2025年第3期
《计算机研究与发展》期刊编辑部
严正声明:本站非期刊官网,非中介代理。
本站仅提供学术规范服务:快速预审、润色编辑服务、中英文查重、降重、去重服务、推荐合适的期刊投稿等学术规范服务。 如需提供学术规范服务请联系在线编辑。