arXiv 人工智能· Tianyu Chen, Mingyuan Zhou, Jiaxing Wu·· 6 小时前AI 评分44
基于多步嵌入检索在视觉空间中学习路由
Learning to Route in Visual Space via Multi-Step Embedding Retrieval
AI 导读
研究团队推出 VHOP 基准框架与 VHOP-Router 训练管线,可直接在视觉隐空间中通过单次工具调用检索链式图像。VHOP-Router 将检索性能从不足 5% 提升至 76.3%,使 AI 智能体搜索成功率提高 52.7%,并将平均 token 长度从 1886 减少 61% 至 728。
来源:arXiv 人工智能 · arxiv.org