跳到正文
原文
arXiv 人工智能· Shishi Xiao, Zichao Wang, Alexa Siu, David H. Laidlaw, Jennifer Healey·· 3 小时前AI 评分43

FigAct:将科学图表转化为用于解释的动态画布

FigAct: Turning Scientific Figures into Active Canvases for Explanation

AI 导读

研究人员推出 FigAct 框架与 FigAct-8B 模型,可直接对静态科学图表中的图形元素进行操作,将其转化为问答驱动的动态视觉演示以引导读者注意力。该框架采用分层搜索策略实现高效的元素定位,将 token 消耗降低约 40x,并基于定位精度、搜索效率与渲染质量三项奖励进行训练。团队还构建了人工验证的评测基准。

来源:arXiv 人工智能 · arxiv.org