स्टैनफोर्ड विश्वविद्यालय की ली फेईफेई टीम ने Masked Visual Actions पेश किया, जिसमें रोबोट के क्रियाकलापों को वीडियो में वस्तुओं की ट्रैजेक्टरी के पिक्सेल स...
论文研究HuggingFace Daily Papers(社区热门论文)
आज का AI इंटेलिजेंस ब्रीफ
स्टैनफोर्ड विश्वविद्यालय की ली फेईफेई टीम ने Masked Visual Actions पेश किया, जिसमें रोबोट के
क्रियाकलापों को वीडियो में वस्तुओं की ट्रैजेक्टरी के पिक्सेल स्पेस मास्क के रूप में प्रदर्शित किया गया। केवल 15 घंटे के वास्तविक और सिमुलेशन डेटा से फाइन-ट्यूनिंग करके, एकल वीडियो मॉडल एक ही समय में फॉरवर्ड डायनेमिक्स मॉडल और इनवर्स मॉडल के रूप में उपयोग किया जा सकता है, नीति मूल्यांकन और मॉडल-आधारित योजना के लिए।
मूल लेख का अंश
arXivLabs is a framework that allows collaborators to develop and share new arXiv features directly on our website.
Have an idea for a project that will add value for arXiv's community? Learn more about arXivLabs :https://info.arxiv.org/labs/index.html.
स्टैनफोर्ड विश्वविद्यालय की ली फेईफेई टीम ने Masked Visual Actions पेश किया, जिसमें रोबोट के क्रियाकलापों को वीडियो में वस्तुओं की ट्रैजेक्टरी के पिक्सेल स...