إعادة التجربة بالأولوية
Prioritized Experience Replay
أسلوب في التعلّم المعزّز يُعيد تشغيل الانتقالات المهمة بوتيرة أعلى بدلاً من السحب المنتظم، مستخدماً مقدار خطأ الفرق الزمني كمقياس لأولوية كل انتقال، مع تصحيح الانحياز الناتج بأوزان أخذ العيّنات بالأهمية.
A reinforcement learning technique that replays important transitions more frequently instead of uniformly sampling, using the magnitude of the TD error as a priority measure for each transition, with importance sampling weights to correct the resulting bias.
تُرجم أيضاًإعادة التشغيل بالأولوية، الإعادة ذات الأولوية
أول ظهور في هذه المجموعة: Rainbow: دمج التحسينات في التعلُّم المعزَّز العميق (2018)
يظهر في هذه الأوراق