Glossary

Proximal Policy Optimization (PPO)

خوارزمية تحسين السياسة القريبة

خوارزمية تعزيز متطورة تضمن تحديث استراتيجية الأفعال بنسب آمنة وتدريجية لمنع انهيار الأداء التدريبي.

Proximal Policy Optimization (PPO)

Also translated asمحسن استراتيجيات الأفعال المحدود التغير، معيار التعديل الآمن والتدريجي للقرارات

First appears in this corpus in: Asynchronous Methods for Deep Reinforcement Learning (2016)

Appears in these papers