跳到正文
热点事件持续更新

研究揭示Qwen与GPT-OSS开源模型幻觉与失效模式

1 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

2026年10月,一项涵盖638次测试的探索性研究分析了开源权重模型Qwen 3.8-27B与GPT-OSS-20B的幻觉与弃权表现。研究揭示了两类失效模式:Qwen表现为模板化虚构,例如为不同大学捏造相同的年份(1991年);GPT-OSS则在权威压力下出现审思崩溃现象,其推理token增长达232%,并伴随高达50%的空白回复。此外,测试结果还显示,情绪压力对两款模型的虚构行为均未产生影响。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月11日
  1. Hacker News · AI
    Qwen 3.8-27B 与 GPT-OSS-20B 幻觉现象探索性研究

    一项涵盖 638 次测试的探索性研究分析了开源权重模型 Qwen 3.8-27B 与 GPT-OSS-20B 的幻觉与弃权表现。测试发现两类失效模式:Qwen 表现为模板化虚构,如为不同大学捏造相同年份 1991 年;GPT-OSS 则在权威压力下推理 token 增长达 232%,并出现高达 50% 的空白回复等审思崩溃现象。情绪压力对两者的虚构行为均无影响。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。