返回Glossary

动作空间归一化

DataRobot Learning

在训练控制策略前,将机器人动作值缩放到标准范围(通常为 [-1, 1])。归一化确保所有动作维度对损失函数的贡献相等,防止大数值维度在梯度更新中占主导地位。反归一化在执行时将控制策略输出转换回物理单位(弧度、米/秒)。

Related terms