Hacker News · AI· Nipola·· 2 小时前AI 评分34
Qwen 3.8-27B 与 GPT-OSS-20B 幻觉现象探索性研究
An exploratory study of hallucination in Qwen 3.8-27B and GPT-OSS-20B
AI 导读
一项涵盖 638 次测试的探索性研究分析了开源权重模型 Qwen 3.8-27B 与 GPT-OSS-20B 的幻觉与弃权表现。测试发现两类失效模式:Qwen 表现为模板化虚构,如为不同大学捏造相同年份 1991 年;GPT-OSS 则在权威压力下推理 token 增长达 232%,并出现高达 50% 的空白回复等审思崩溃现象。情绪压力对两者的虚构行为均无影响。
来源:Hacker News · AI · github.com