Model-Free RL
التعلم بالتعزيز المباشر (دون نموذج بيئة)
خوارزميات تعزيز تتعلم مباشرة عبر خوض التجربة والخطأ دون الحاجة لبناء نموذج محاكاة للبيئة.
Model-Free RL
Also translated asالخوارزميات المعتمدة على التجربة المباشرة، التعلم التدعيمي الحر من القيود التنبؤية
First appears in this corpus in: Q-Learning (1992)
Appears in these papers