返回Glossary

安全约束强化学习

Robot LearningRLSafety

约束强化学习,在满足安全约束(如碰撞概率<0.01、关节扭矩限制)的同时优化回报。约束策略优化(CPO)、拉格朗日方法和控制屏障函数是常见方法。安全强化学习对于实际机器人部署至关重要,因为约束违反可能损坏硬件或伤害人员。

Related terms