VLALight koristi mali vision-language-action model za upravljanje semaforima
Novi rad predlaže VLALight, end-to-end sistem koji više pogleda raskrsnice pretvara direktno u odluke o fazama semafora i posebno optimizuje prolaz vozila hitnih službi.

Više kamera u jednom vizuelnom ulazu
VLALight kombinuje više smerova kamera u jedinstven vizuelni ulaz, a tekstualnim instrukcijama povezuje te poglede sa kretanjem saobraćaja i fazama semafora.
Sistem koristi kompaktan model od 0,5 milijardi parametara i direktno predviđa akciju bez međukoraka u kojima bi sliku pretvarao u tekst ili koristio ručno konstruisanu reprezentaciju saobraćajnog stanja.
Manje čekanja za vozila hitnih službi
U eksperimentima autori navode da je VLALight ostvario najbolju uslugu za vozila hitnih službi među poređenim metodama.
Ukupno čekanje vozila hitnih službi bilo je 21,1% manje nego kod kaskadnog VLMLight sistema, dok je model radio u realnom vremenu na lokalnom hardveru i generalizovao na nepoznate topologije raskrsnica i obrasce protoka.
Izvori
Prikazani su izvorni linkovi korišćeni za proveru objavljenih činjenica.
