arXiv cs.RO· Aditya Ramabadran, Simon Mahns, Tobias Gessler·· 6 小时前精选AI 评分66
DrivingBench:视觉语言模型能否驾驶丰田卡罗拉
DrivingBench: Can Vision-Language Models Drive a Toyota Corolla?
AI 导读
研究团队提出 DrivingBench,据其所述是首个要求通用视觉语言模型驾驶真车的基准,模型通过三个工具读取丰田卡罗拉的摄像头画面,直接控制转向与速度,在低速停车场锥桶路线中行驶。
推荐理由
读者可了解一个让通用视觉语言模型直接驾驶真车的基准设计,以及延迟与工具格式如何影响模型能否完成长程任务。
来源:arXiv cs.RO · arxiv.org