arXiv 机器学习· Xinhe Wu, Yadong Jin·· 5 小时前AI 评分32
ChartDensity-Bench:评测 MLLM 在视觉密度下的数值数据重构能力
ChartDensity-Bench: Benchmarking MLLMs for Numerical Data Reconstruction under Visual Density
AI 导读
研究者推出 ChartDensity-Bench 基准,用于评估多模态大语言模型(MLLM)在不同视觉密度的复合图表下重构结构化数值数据的能力。该基准通过系统调整同时展示的图表数量(k∈{1,3,6,9}),从结构可靠性、重构完整性、可解析性与数值保真度四个维度进行评测。在 5 款 MLLM 上的实验显示,数值重构性能随视觉密度增加普遍下降,相同图表置于更密集的上下文中会出现更高误差。
来源:arXiv 机器学习 · arxiv.org