Il team di Fei-Fei Li all'Università di Stanford ha proposto Masked Visual Actions, che rappresenta le azioni del robot come maschere nello spazio dei pixe...
论文研究HuggingFace Daily Papers(社区热门论文)
Brief quotidiano sull’IA
Il team di Fei-Fei Li all'Università di Stanford ha proposto Masked Visual Actions, che rappresenta
le azioni del robot come maschere nello spazio dei pixel delle traiettorie degli oggetti nel video. Utilizzando solo 15 ore di dati reali e simulati per il fine-tuning, un singolo modello video può fungere sia da modello di dinamica diretta che inversa, per la valutazione delle strategie e la pianificazione basata sul modello.
Estratto dell’articolo originale
arXivLabs is a framework that allows collaborators to develop and share new arXiv features directly on our website.
Have an idea for a project that will add value for arXiv's community? Learn more about arXivLabs :https://info.arxiv.org/labs/index.html.
Il team di Fei-Fei Li all'Università di Stanford ha proposto Masked Visual Actions, che rappresenta le azioni del robot come maschere nello spazio dei pixe...