arXiv 机器学习· Mohamed Chouai, Fazli Faruk Okumus, Stefan Kugele·· 1 天前AI 评分34
将视觉语言模型扎根于驾驶语义:面向可解释推理的多数据集谓词框架
Grounding Vision-Language Models in Driving Semantics: A Multi-Dataset Predicate Framework for Explainable Reasoning
AI 导读
研究人员提出一种确定性多数据集谓词框架,可从几何、运动学与地图等数据推导驾驶场景语义,并在 nuPlan 与 nuScenes 数据集上构建通用谓词知识图谱(Predicate KG)。
来源:arXiv 机器学习 · arxiv.org