Diffusionspolitik
Die Diffusionspolitik: Roboterverhalten als bedingte Diffusion. Columbia. +46,9% gegenüber früheren Methoden. Open Source.
[← Modelle]
Das Bildmotorpolitiklernen durch bedingte Verkürzung.
Überblick
Die Diffusion Policy repräsentiert das Verhalten von Robotern als bedingte Diffusionsprozess. Es verwaltet multimodal Aktionsverteilungen, hochdimensionalen Aktionsräume und zeigt eine starke Trainingsstabilität. Durchschnittliche Verbesserung von +46,9% gegenüber früheren Methoden in 15 Manipulationsarbeiten.
Architektur
- Rückkehr der Horizontkontrolle
- Bildverarbeitung
- Zeitreihen-Diffusionstransformatoren
- IJRR 2024
Offizielle Verbindungen
- diffusion-policy.cs.columbia.edu
Projektseite - github.com/columbia-ai-robotics/diffusion_policy
Code, Daten, Colab
Zitat
Siehe die Projektseite für BibTeX.
Jeder VLA hier kann auf Ihre eigenen Demonstrationen abgestimmt werden.
Sammeln Sie Demo → Hardware, die es läuft → Score eine Politik →







