跳到正文
原文
arXiv 机器学习· Mohamed Chouai, Fazli Faruk Okumus, Stefan Kugele·· 1 天前AI 评分34

将视觉语言模型扎根于驾驶语义:面向可解释推理的多数据集谓词框架

Grounding Vision-Language Models in Driving Semantics: A Multi-Dataset Predicate Framework for Explainable Reasoning

AI 导读

研究人员提出一种确定性多数据集谓词框架,可从几何、运动学与地图等数据推导驾驶场景语义,并在 nuPlan 与 nuScenes 数据集上构建通用谓词知识图谱(Predicate KG)。

来源:arXiv 机器学习 · arxiv.org