跳到正文
原文
arXiv 人工智能· Jiawei Li·· 5 小时前AI 评分54

LLM Agent 框架中 System-1 决策模型的配对与自审评测研究

Fast Models, Slow Evidence: A Paired and Self-Audited Evaluation of System-1 Decision Models for LLM Agent Harnesses

AI 导读

研究针对 LLM Agent 框架中负责工具选择、注入检测等轻量决策的 System-1 模型开展了配对评测与流程自审,对比了开源模型 Laya 与托管模型 Jev。

来源:arXiv 人工智能 · arxiv.org