AIDC
← 返回全部动态
arXiv 人工智能AI 评分 68/10009月29日 12:00

DriveHierarchy:贯通开环理解与闭环执行的VLM自动驾驶分层评测基准

评估基于视觉语言模型(VLM)的自动驾驶系统难度较大,因其能力具有复合性,涵盖交通参与者定位、时空上下文整合、未来演化推理及闭环交互行动等。针对现有评测多局限于孤立的开环理解或闭环驾驶、缺乏系统诊断能力的痛点,研究团队提出了分层基准 DriveHierarchy,系统化解构并关联多层级驾驶能力,为大模型端到端自动驾驶的诊断与改进提供评测支持。

推荐理由针对VLM在自动驾驶中从认知到执行的断层问题提出了系统化的分层评测体系,对端到端智驾模型诊断有一定参考价值。

原标题:DriveHierarchy: A Benchmark for Diagnosing VLM Driving Capabilities from Open-Loop Understanding to Closed-Loop Execution

阅读 arXiv 人工智能 原文 ↗

同一事件的其他来源

arXiv 机器学习09月29日 12:00

面向可解释推理的自动驾驶多数据集语义谓词框架

该研究针对视觉语言模型在驾驶场景理解中语义关系难以与真实交通状况核验的问题,提出了一个确定性多数据集谓词框架。该框架从几何、运动学、时间、地图及交通控制等可测量物理证据中推导驾驶语义,并在nuPlan和nuScenes等数据集间保持谓词定义统一,构建了统一的谓词知识体系,以增强自动驾驶场景推理的可解释性与可验证性。