التعلُّم المعزَّز التوزيعي
Distributional Reinforcement Learning
نهج في التعلُّم المعزَّز يتعلّم فيه الوكيل التوزيع الاحتمالي الكامل للعوائد بدلاً من قيمتها المتوقعة فقط، مما يوفر إشارة تعلُّم أغنى ويلتقط معلومات المخاطر.
A reinforcement learning approach where the agent learns the full probability distribution of returns rather than just the expected value, providing a richer learning signal and capturing risk information.
تُرجم أيضاًالتعلُّم المعزَّز التوزيعي، RL التوزيعي
أول ظهور في هذه المجموعة: Rainbow: دمج التحسينات في التعلُّم المعزَّز العميق (2018)
يظهر في هذه الأوراق