An interactive enhanced driving dataset for autonomous driving
Questo paper presenta l'IEDD, un dataset interattivo su larga scala per la guida autonoma che supera le limitazioni dei dati esistenti attraverso un pipeline di estrazione di segmenti interattivi e la creazione di un dataset VQA con allineamento multimodale rigoroso, dimostrando il suo valore nel valutare e affinare le capacità di ragionamento dei modelli Vision-Language-Action.