Hacker News · AI· maxloh·· 4 小时前精选AI 评分60
研究发现千问(Qwen)内置内容审查与偏见,安全公司尝试通过编辑权重去偏
Some topics are off limits inside popular Chinese-made free AI, researchers find
AI 导读
以色列网络安全初创公司 Hirundo 等机构的研究显示,全球下载量超 30 亿次的开源模型千问(Qwen)在涉及敏感政治与历史议题时存在明显的审查机制与特定偏见。
推荐理由
原文披露了开源大模型在全球企业落地中的合规与偏见争议,并提供了通过神经元权重编辑进行模型再对齐的技术路径参考。
来源:Hacker News · AI · cbsnews.com