跳到正文
原文
MIT Technology Review AI· Thore Graepel·· 2 小时前精选AI 评分67

前 DeepMind 核心成员撰文:大语言模型并未真正进行推理

Don’t be fooled—LLMs don’t reason

AI 导读

前 DeepMind AlphaGo 核心成员 Thore Graepel 撰文指出,当前大语言模型(LLM)本质上仍是基于下一个 token 预测的直觉模式,即使引入思维链也未形成真正的独立推理机制。文章分析了 LLM 缺乏显式认知状态、知识与推理逻辑高度交织以及思维链常属事后编造三大缺陷,主张借鉴 AlphaGo 架构构建具备证据检验与信念更新的可审计推理系统。

推荐理由

文章对比了 AlphaGo 的显式搜索与大语言模型的自回归机制,指出了当下思维链并非真正推理的核心缺陷。

来源:MIT Technology Review AI · technologyreview.com