Zespół Li Feifei z Uniwersytetu Stanforda zaproponował Masked Visual Actions, przedstawiając ruchy robota jako maski w przestrzeni pikseli trajektorii obie...
论文研究HuggingFace Daily Papers(社区热门论文)
Dzisiejszy biuletyn AI
Zespół Li Feifei z Uniwersytetu Stanforda zaproponował Masked Visual Actions, przedstawiając ruchy
robota jako maski w przestrzeni pikseli trajektorii obiektów w wideo. Po zaledwie 15 godzinach dostosowywania na rzeczywistych i symulowanych danych, pojedynczy model wideo może służyć zarówno jako model dynamiki w przód, jak i jako model odwrotny, wykorzystywany do oceny strategii i planowania opartego na modelu.
Fragment oryginalnego artykułu
arXivLabs is a framework that allows collaborators to develop and share new arXiv features directly on our website.
Have an idea for a project that will add value for arXiv's community? Learn more about arXivLabs :https://info.arxiv.org/labs/index.html.
Zespół Li Feifei z Uniwersytetu Stanforda zaproponował Masked Visual Actions, przedstawiając ruchy robota jako maski w przestrzeni pikseli trajektorii obie...