热点事件持续更新
研究揭示Qwen与GPT-OSS开源模型幻觉与失效模式
1 篇报道1 个报道来源2 小时前更新
先了解这件事
AI 综述
2026年10月,一项涵盖638次测试的探索性研究分析了开源权重模型Qwen 3.8-27B与GPT-OSS-20B的幻觉与弃权表现。研究揭示了两类失效模式:Qwen表现为模板化虚构,例如为不同大学捏造相同的年份(1991年);GPT-OSS则在权威压力下出现审思崩溃现象,其推理token增长达232%,并伴随高达50%的空白回复。此外,测试结果还显示,情绪压力对两款模型的虚构行为均未产生影响。
AI 根据报道生成 · 1 小时前更新
最新进展10月11日 18:42
研究显示Qwen易出现模板化虚构,GPT-OSS在权威压力下推理token激增且空白回复达50%。报道时间线
沿着报道,了解事件的不同侧面。
10月11日
- Hacker News · AIQwen 3.8-27B 与 GPT-OSS-20B 幻觉现象探索性研究
一项涵盖 638 次测试的探索性研究分析了开源权重模型 Qwen 3.8-27B 与 GPT-OSS-20B 的幻觉与弃权表现。测试发现两类失效模式:Qwen 表现为模板化虚构,如为不同大学捏造相同年份 1991 年;GPT-OSS 则在权威压力下推理 token 增长达 232%,并出现高达 50% 的空白回复等审思崩溃现象。情绪压力对两者的虚构行为均无影响。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。