Glossary पर वापस जाएं

कार्रवाई स्पेस सामान्यीकरण

DataRobot Learning

एक नीति को प्रशिक्षित करने से पहले रोबोट कार्रवाई मानों को एक मानक श्रेणी (आमतौर पर [-1, 1]) में स्केल करना। सामान्यीकरण सुनिश्चित करता है कि सभी कार्रवाई आयाम नुकसान फ़ंक्शन में समान रूप से योगदान करते हैं और बड़े-मूल्य वाले आयामों को ग्रेडिएंट अपडेट पर हावी होने से रोकता है। Denormalization निष्पादन समय पर नीति आउटपुट को भौतिक इकाइयों (रेडियन, मीटर/सेकंड) में परिवर्तित करता है।

Related terms