التعلم بالتعزيز المعتمد على بناء بيئة
Model-Based RL
خوارزميات تعزيز تبني نموذجاً داخلياً للتنبؤ بديناميكية البيئة ومحاكمة الأفعال قبل تنفيذها واقعياً.
Model-Based RL
تُرجم أيضاًالخوارزميات الحاوية لنموذج تنبؤي داخلي، التعلم التدعيمي المتمحور حول محاكاة المحيط
أول ظهور في هذه المجموعة: مقترح مشروع دارتموث الصيفي للبحث في الذكاء الاصطناعي (1956)
يظهر في هذه الأوراق
- مقترح مشروع دارتموث الصيفي للبحث في الذكاء الاصطناعي1956في السماء ✦
- إتقان مجالات متنوّعة عبر نماذج العالم2023في السماء ✦
- MuZero: إتقان ألعاب Atari وGo والشطرنج وShogi بالتخطيط عبر نموذج مُتعلَّم2020في السماء ✦
- بين عمليات ماركوف القرارية وشبه الماركوفية — إطار التجريد الزمني في التعلّم المعزَّز1999في السماء ✦
- نماذج العالَم2018في السماء ✦