AIDC
← 返回全部动态
Apple Machine Learning ResearchAI 评分 72/10009月24日 08:00

苹果提出隐空间蒸馏技术:压缩端侧流式神经音频编码器

苹果系统级听写功能完全在设备端运行,音频需通过编码器分词后输入基础模型。针对端侧常驻分词器与稀疏激活模型争抢 DRAM 内存、影响功耗和延迟的问题,研究团队提出了基于隐空间蒸馏的流式神经音频编码器压缩方法,有效降低了编码器参数量与计算开销,提升了端侧语音识别的资源利用效率。

推荐理由苹果针对端侧基础模型音频前端的内存与功耗瓶颈提出的模型蒸馏优化方案,对端侧语音部署具较高工程参考价值。

原标题:Compressing Streaming Neural Audio Encoders via Latent-Space Distillation

阅读 Apple Machine Learning Research 原文 ↗