Glossary पर वापस जाएं

नीति आसवन

Robot LearningML

एक बड़ी या जटिल नीति (शिक्षक) को एक छोटी, तेज़ नीति (छात्र) में संपीड़ित करना KL विचलन न्यूनीकरण के माध्यम से छात्र को शिक्षक की कार्रवाई वितरण से मेल खाने के लिए प्रशिक्षित करके। नीति आसवन का उपयोग किया जाता है: वास्तविक समय तैनाती के लिए RL नीतियों को संपीड़ित करने के लिए, सिमुलेशन से वास्तविक हार्डवेयर में स्थानांतरण के लिए, और कई विशेष नीतियों को एक में संयोजित करने के लिए।

Related terms