Aprendizaje a partir de la Observación
Aprendizaje por imitación a partir de demostraciones en video que muestran solo estados (observaciones) sin etiquetas de acciones — el observador ve qué se hizo pero no cómo. Los algoritmos LfO deben inferir acciones a partir de diferencias de estado utilizando modelos de dinámica inversa. Este escenario permite aprender a partir de videos de robots de internet donde las etiquetas de acciones no están disponibles.







