Обучение из игры
Обучение подражанием из неструктурированных данных игры — телеуправляемое исследование робота, где человек взаимодействует с окружением без следования конкретной задаче. Данные игры дешевы в сборе (не требуется спецификация задачи) и разнообразны. Алгоритмы LfP, такие как PLAY-LMP, извлекают переиспользуемые библиотеки навыков из датасетов игры, обеспечивая обучение целевым нисходящим задачам.







