المعجم

التعلم بالتعزيز المعتمد على بناء بيئة

Model-Based RL

خوارزميات تعزيز تبني نموذجاً داخلياً للتنبؤ بديناميكية البيئة ومحاكمة الأفعال قبل تنفيذها واقعياً.

Model-Based RL

تُرجم أيضاًالخوارزميات الحاوية لنموذج تنبؤي داخلي، التعلم التدعيمي المتمحور حول محاكاة المحيط

أول ظهور في هذه المجموعة: مقترح مشروع دارتموث الصيفي للبحث في الذكاء الاصطناعي (1956)

يظهر في هذه الأوراق