Назад к Glossary

Нейронная политика управления

PolicyDeep Learning

Нейронная политика управления — это политика управления роботом, параметризованная нейронной сетью, которая отображает наблюдения (изображения, проприоцепция, язык) непосредственно в действия (позиции суставов, декартовы дельты, команды захвата). В отличие от классических конвейеров планирования движения, нейронные политики изучают отображение сквозным образом из данных без ручного проектирования промежуточных представлений. Современные нейронные политики используют свёрточные кодировщики для видения, Transformer для моделирования последовательностей и архитектуры, такие как ACT, Diffusion Policy или основы VLA для генерации действий. Ключевое свойство нейронных политик заключается в том, что они могут быть обучены на демонстрациях или сигналах вознаграждения, что позволяет им справляться с задачами, слишком сложными для ручных контроллеров. Смотрите это на практике: наши оценки в реальном мире →

Related terms