跳到正文
原文
Hacker News · AI· giampycolella·· 3 小时前AI 评分39

Kairos 实验:我如何证伪自己的 AI 记忆框架

Kairos Experiment – How I disproved my own AI memory framework

AI 导读

Kairos 独立研究实验发现,LLM 裁判与召回探测器无法可靠区分真实记忆与看似合理的故事叙述。测试显示,7 个受试模型全部会顺应被篡改的历史记录,其中 5 个模型在空上下文下仅凭叙述合理性即可取得 62%–79% 的探测分数,3 位裁判对伪造记忆与真实记录也给出了等价评分。

来源:Hacker News · AI · kairos-experiment.com