机器人评估数据集
需要可比较的场景,可重复的重设和部署的测试循环的机器人团队的评估数据集.
评估数据集在团队需要重复性,场景标签和基准调整时重要,而不是更多原始的培训数据.
核心要求
- 重置纪律场景可复制性是基准要求.
- 结果定义团队需要明确的成功,部分成功和失败的语义.
- 覆盖地图良好的评估集显示了政策仍然无法做到的.
相关链接
- 实际世界评估中心
- [评估文章]
- [可评估的模型]
商业用途
这页应该吸引买家和技术领先者在部署之前寻找证据,
需要可比较的场景,可重复的重设和部署的测试循环的机器人团队的评估数据集.
评估数据集在团队需要重复性,场景标签和基准调整时重要,而不是更多原始的培训数据.
核心要求
相关链接
商业用途
这页应该吸引买家和技术领先者在部署之前寻找证据,