AI menja ponašanje vozila u videu — novi test proverava da li ostatak scene ostaje stvaran

Novi benchmark testira counterfactual roadside video generaciju kroz četiri uslova: tačno početno stanje, validnu rutu i ponašanje, doslednu interakciju i očuvanje svega što nije cilj izmene.

Counterfactual promena bez rušenja ostatka scene

Autori predstavljaju TrafficImag kao benchmark za counterfactual generisanje roadside saobraćajnog videa.

Svaka intervencija zapisana je kao program na nivou aktera koji opisuje ciljano vozilo ili učesnika, željeno ponašanje, dozvoljenu rutu, red interakcija i vremenska ograničenja.

Četiri uslova moraju proći zajedno

Benchmark meri četiri dimenzije validnosti i smatra counterfactual uspešnim tek kada su početno stanje, ruta i ponašanje, interakcije i očuvanje neciljanih elemenata svi ispravni.

Najbolji reasoning model u testovima dostigao je 80,4% macro-F1, dok je potpuni condition interfejs podigao end-to-end uspeh najboljeg generatora sa 23,3% na 55,0%.

Oracle studije ukazuju da conditional video execution ostaje glavno preostalo usko grlo.

Zašto je važno

Nije dovoljno da AI samo napravi ubedljiv video: benchmark zahteva da ciljano ponašanje bude ispravno, a da ostali delovi scene ostanu nepromenjeni.

Najbolji testirani generator je sa potpunim uslovljavanjem podigao end-to-end uspeh sa 23,3 na 55 odsto, što istovremeno pokazuje napredak i koliko prostora za greške još postoji.

Izvori

Prikazani su izvorni linkovi korišćeni za proveru objavljenih činjenica.

Komentari

Komentari se objavljuju nakon moderacije.

Još nema objavljenih komentara.