首页 正文

Extending Large Vision-Language Model for Diverse Interactive Tasks in Autonomous Driving

{{output}}
Large Vision-Language Models (LVLMs) have significantly advanced image understanding. Their comprehension and reasoning capabilities enable promising applications in autonomous driving scenarios. However, existing research typically focuses on partial objects ... ...