跳到正文
原文
AITNT · AI头条(网页)·· 3 小时前AI 评分54

墨尔本大学等提出多会话语音记忆基准 VoxMem

多会话语音记忆基准VoxMem,专治音频大模型记不住「谁说的、怎么说」

AI 导读

墨尔本大学与新南威尔士大学联合团队推出多会话语音记忆基准 VoxMem,用于系统评估音频大模型跨会话记忆说话人身份、语气及环境声等非文本信息的能力。该基准包含 3,196 个评测实例与约 177 小时语音,评测显示 15 个主流模型在 32K 历史长度下整体准确率均未突破 40%,追踪语气与背景声变化的平均准确率仅为 3.4% 与 1.2%。

来源:AITNT · AI头条(网页) · aitntnews.com