Voltar para Glossary

Ensemble Temporal

Robot LearningPolicy

Uma técnica de tempo de inferência usada com políticas de fragmentação de ação (como ACT) onde predições de ação sobrepostas de passos de tempo consecutivos são mediadas para produzir movimento mais suave e consistente. Se a política prediz 50 ações futuras em cada passo, e os passos se sobrepõem em 40 ações, as 40 predições sobrepostas são ponderadas exponencialmente e mediadas. Isso reduz tremulação e melhora a qualidade da execução.

Related terms