Stanford Üniversitesi'nden Li Feifei ekibi, robot hareketlerini videodaki nesne izlerinin piksel alanı maskesi olarak temsil eden Masked Visual Actions'ı ö...
alanı maskesi olarak temsil eden Masked Visual Actions'ı önerdi. Sadece 15 saat gerçek ve simülasyon verisi ile ince ayar yaparak, tek bir video modeli hem ileriye dönük dinamik model hem de ters model olarak kullanılabiliyor ve politika değerlendirmesi ile model tabanlı planlama için kullanılabiliyor.
Orijinal makale alıntısı
arXivLabs is a framework that allows collaborators to develop and share new arXiv features directly on our website.
Have an idea for a project that will add value for arXiv's community? Learn more about arXivLabs :https://info.arxiv.org/labs/index.html.
Stanford Üniversitesi'nden Li Feifei ekibi, robot hareketlerini videodaki nesne izlerinin piksel alanı maskesi olarak temsil eden Masked Visual Actions'ı ö...