Política de difusión
Política de difusión: comportamiento del robot como conditiona denociando la difusión. Columbia. +46.9% sobre métodos anteriores. código abierto.
[← Modelos]
Aprendizaje de políticas visuales motoras a través de la difusión de denotación condicional.
En general
La política de difusión representa el comportamiento del robot como un proceso de difusión conditional denoising. maneja distribuciones de acción multimodal, espacios de acción de alta dimensión y muestra una fuerte estabilidad de entrenamiento.
Arquitectura
- Control de horizonte recesivo
- Condicionamiento visual
- Transformadores de difusión de serie temporal
- RICR de 2024
Enlaces oficiales
- [difusión-política.cs.columbia.edu]
T1 ) Sitio del proyecto - github.com/columbia-ai-robotics/difusión_política
Código, datos, Colab
Citación
IJRR 2024. Véase el sitio del proyecto de BibTeX.
Cada VLA aquí puede ser ajustado a sus propias demostraciones.
Recoge demos → Hardware que lo ejecuta → Corre una política →







