跳到正文
原文
arXiv 机器学习· Xinhe Wu, Yadong Jin·· 5 小时前AI 评分32

ChartDensity-Bench:评测 MLLM 在视觉密度下的数值数据重构能力

ChartDensity-Bench: Benchmarking MLLMs for Numerical Data Reconstruction under Visual Density

AI 导读

研究者推出 ChartDensity-Bench 基准,用于评估多模态大语言模型(MLLM)在不同视觉密度的复合图表下重构结构化数值数据的能力。该基准通过系统调整同时展示的图表数量(k∈{1,3,6,9}),从结构可靠性、重构完整性、可解析性与数值保真度四个维度进行评测。在 5 款 MLLM 上的实验显示,数值重构性能随视觉密度增加普遍下降,相同图表置于更密集的上下文中会出现更高误差。

来源:arXiv 机器学习 · arxiv.org