Zurück zu VLA Models

Diffusionspolitik

Die Diffusionspolitik: Roboterverhalten als bedingte Diffusion. Columbia. +46,9% gegenüber früheren Methoden. Open Source.

[← Modelle]

Das Bildmotorpolitiklernen durch bedingte Verkürzung.

Überblick

Die Diffusion Policy repräsentiert das Verhalten von Robotern als bedingte Diffusionsprozess. Es verwaltet multimodal Aktionsverteilungen, hochdimensionalen Aktionsräume und zeigt eine starke Trainingsstabilität. Durchschnittliche Verbesserung von +46,9% gegenüber früheren Methoden in 15 Manipulationsarbeiten.

Architektur

  • Rückkehr der Horizontkontrolle
  • Bildverarbeitung
  • Zeitreihen-Diffusionstransformatoren
  • IJRR 2024

Offizielle Verbindungen

Zitat

Siehe die Projektseite für BibTeX.

Jeder VLA hier kann auf Ihre eigenen Demonstrationen abgestimmt werden.

Sammeln Sie Demo → Hardware, die es läuft → Score eine Politik →