El equipo de Fei-Fei Li en la Universidad de Stanford propuso Acciones Visuales Enmascaradas (Masked Visual Actions), que representa las acciones del robot...
论文研究HuggingFace Daily Papers(社区热门论文)
Resumen diario de inteligencia IA
El equipo de Fei-Fei Li en la Universidad de Stanford propuso Acciones Visuales Enmascaradas (Masked
Visual Actions), que representa las acciones del robot como máscaras en el espacio de píxeles de las trayectorias de los objetos en el video. Con solo 15 horas de datos reales y simulados para ajuste fino, un solo modelo de video puede funcionar simultáneamente como modelo de dinámica directa y como modelo inverso, para la evaluación de estrategias y la planificación basada en modelos.
Artículo y notas de fuente
arXivLabs is a framework that allows collaborators to develop and share new arXiv features directly on our website.
Have an idea for a project that will add value for arXiv's community? Learn more about arXivLabs :https://info.arxiv.org/labs/index.html.
El equipo de Fei-Fei Li en la Universidad de Stanford propuso Acciones Visuales Enmascaradas (Masked Visual Actions), que representa las acciones del robot...