跳到正文
原文
arXiv 机器学习· Ali Alavi, Donald S. Williamson·· 3 小时前AI 评分36

语音质量评估指标有多容易被攻击?修正协议、基准与修补效果分析

How Hackable Is Your Speech Quality Metric? A Corrected Protocol, a Benchmark, and What Patching Buys

AI 导读

新研究提出了修正的语音质量预测指标抗攻击评估协议与基准,发现主流预测器被攻击成功率差异显著,NISQA 达 90%,SSL-MOS 为 21%,DNSMOS 为 14%,UTMOS 为 6%。闭环修补仅在自身攻击空间内有效且会导致高达 0.30 的域外系统 SRCC 损失,但针对修补指标后训练的增强器对抗攻击明显减弱(PESQ 变化为 -0.03 对比 -0.23)。相关代码已开源。

来源:arXiv 机器学习 · arxiv.org