跳到正文
原文
arXiv 自然语言处理· Saurabh Kumar Singh, Yogeshwar Singh Dadwhal, Malhar Vedak·· 6 小时前AI 评分43

GGUF 激进量化使小语言模型能写出罕见词却无法定义其含义

Saying, Not Knowing: Aggressively GGUF-Quantized Small Language Models Still Write Rare Words They Can No Longer Define

AI 导读

研究显示,激进的 GGUF 混合精度量化(如 Q2_K)会导致 2B 参数以下的小语言模型出现严重语义解离,模型虽能流畅输出罕见词却已无法正确给出其定义。在对 0.35B-14B 参数的 27 个模型评估中,2B 以下模型定义准确率下降 20-67%,而 3B 以上模型及 1B 以上的 Q4_K_M 表现大多稳健。该损伤无法被 WikiText-2 困惑度校准,为注重语义准确性的端侧部署带来风险。

来源:arXiv 自然语言处理 · arxiv.org