Kontinuierliche Regelung
Kontinuierliche Regelung bezieht sich auf Roboter-Regelungen, die reellwertige Aktionsvektoren ausgeben (z. B. Gelenkmomente, Geschwindigkeiten oder kartesische Deltas) anstatt aus einer diskreten Menge von Aktionen auszuwählen. Die meisten physischen Roboter-Manipulationsaufgaben erfordern kontinuierliche Regelung, da glatte, präzise Bewegungen nicht angemessen durch ein endliches Aktionsmenü dargestellt werden können. Standard-Deep-RL-Algorithmen für kontinuierliche Regelung umfassen DDPG, TD3 und SAC; für Imitationslernen werden Verhaltensklonen und Diffusion Policy häufig in kontinuierlichen Aktionsräumen verwendet. Siehe dies in der Praxis: der Hardware-Store →







