A equipe de Fei-Fei Li da Universidade de Stanford propôs o Masked Visual Actions, que representa as ações do robô como máscaras de espaço de pixels das tr...
论文研究HuggingFace Daily Papers(社区热门论文)
Resumo diário de inteligência em IA
A equipe de Fei-Fei Li da Universidade de Stanford propôs o Masked Visual Actions, que representa as
ações do robô como máscaras de espaço de pixels das trajetórias de entidades em vídeo. Com apenas 15 horas de dados reais e simulados para ajuste fino, um único modelo de vídeo pode atuar simultaneamente como modelo de dinâmica direta e modelo inverso, sendo usado para avaliação de políticas e planejamento baseado em modelo.
Trecho do artigo original
arXivLabs is a framework that allows collaborators to develop and share new arXiv features directly on our website.
Have an idea for a project that will add value for arXiv's community? Learn more about arXivLabs :https://info.arxiv.org/labs/index.html.
A equipe de Fei-Fei Li da Universidade de Stanford propôs o Masked Visual Actions, que representa as ações do robô como máscaras de espaço de pixels das tr...