Назад к Glossary

Оптимизация траектории

Robot LearningControlPlanning

Вычисление оптимальной траектории (последовательности состояний и управлений), которая минимизирует функцию стоимости при ограничениях динамики. Методы включают shooting (оптимизация только управлений), collocation (совместная оптимизация состояний и управлений) и дифференциальное динамическое программирование (DDP/iLQR). Оптимизация траектории используется для планирования движения, предсказательного управления моделью и генерации экспертных демонстраций для имитационного обучения.

Related terms