Buzzing HN · 中文精选· nicowaltz·· 15 小时前AI 评分60
PostHog 开源 Jeeves 决策模型:基于 Qwen3.5-9B 结合链式推理与扩散推测解码
吉夫斯。推理能力提升了“吉夫斯式”决策模型
AI 导读
PostHog 开源决策分类模型 Jeeves,基于 Qwen3.5-9B 结合 LoRA、指针头与 CISPO 强化学习训练,使分类器在输出最终决策前展开链式推理。
来源:Buzzing HN · 中文精选 · github.com
吉夫斯。推理能力提升了“吉夫斯式”决策模型
PostHog 开源决策分类模型 Jeeves,基于 Qwen3.5-9B 结合 LoRA、指针头与 CISPO 强化学习训练,使分类器在输出最终决策前展开链式推理。
来源:Buzzing HN · 中文精选 · github.com