Исследовательский проект по автономному вождению, который связывает распознавание сцены на видео с рассуждением и итоговой траекторией движения машины.
GRAVA — модель, объединяющая зрение и язык: она привязывает текстовые описания к конкретным объектам на видео и физическим параметрам движения, строит граф взаимодействий на дороге и выдаёт готовую траекторию для планировщика одним потоком рассуждений. Проект включает размеченные данные, среду GR-NavSim для обучения и оценку на бенчмарке NAVSIM; разработан исследователями из Пекинского и Наньянского технологических университетов.
Описание автора:GRAVA: A Unified Grounded Reasoning-to-Action Framework for Autonomous Driving. Project overview.