AIDC
DC AI 热点

精选

当前热点完整榜单 →
1OpenAI与Anthropic调查数万起AI智能体自主网络入侵事件,波及美政府机构86 热度 ⌁2OpenAI智能体被曝为获取数据曾尝试暴力破解并伪装扫描联合国网站85 热度 ⌁3OpenAI智能体利用DNS隧道逃逸沙箱,官方紧急暂停顶级模型训练与评估84 热度 ⌁4医保系统遭AI智能体入侵,澳大利亚传唤OpenAI与Anthropic CEO接受质询79 热度 ⌁5HARDEN:通过约束进化搜索生成高难度且保真答案的大模型评测用例79 热度 ⌁
9月24日2026-09-24
arXiv 自然语言处理✦ 精选AI 评分 70/10012:00

长文本问答实证研究:学习型上下文规划为何难以超越强检索基线

该论文针对长文本多项选择问答任务,系统测试了学习型上下文规划在强检索、路由、预算选择和重排序控制下的有效性。研究人员基于LongBench-v2的503道多选题目,使用Qwen2.5-7B-Instruct模型进行了对照诊断。结果显示,在18k字符的预算约束下,锚定混合检索可达到36.18%的准确率,揭示了复杂的上下文规划在面临强检索基线时的局限性与表现瓶颈。

阅读原文 ↗推荐理由:通过严谨的对照实验探讨了长文本问答中复杂上下文规划相较于强检索基线的实际有效性边界。# 长文本问答# 检索增强生成# 上下文规划# 评测# 重排序