الاستنساخ السلوكي
Behavioral Cloning
أسلوب تعلم خاضع للإشراف في التعلم بالتقليد يُدرَّب فيه النموذج على التنبؤ مباشرةً بأفعال الخبير من الملاحظات. يستخدم RT-2 الاستنساخ السلوكي بدلاً من التعلم المعزز.
A supervised learning approach to imitation learning where the policy is trained to directly predict expert actions from observations. RT-2 uses behavioral cloning rather than reinforcement learning.
تُرجم أيضاًالتقليد السلوكي، النسخ السلوكي الخاضع للإشراف
أول ظهور في هذه المجموعة: محوِّل القرار: التعلّم المعزَّز عبر نمذجة التسلسلات (2021)
يظهر في هذه الأوراق
- تعلُّم التحكّم الثنائي الدقيق بعتاد منخفض التكلفة2023في السماء ✦
- محوِّل القرار: التعلّم المعزَّز عبر نمذجة التسلسلات2021في السماء ✦
- سياسة الانتشار: تعلُّم السياسات البصرية-الحركية بانتشار الأفعال2023في السماء ✦
- وكيل واحد لكل المهام2022في السماء ✦
- Open X-Embodiment: مجموعات بيانات التعلّم الروبوتي ونماذج RT-X2024في السماء ✦
- RT-1: محوِّل الروبوتات للتحكم الواقعي على نطاق واسع2022في السماء ✦
- نفِّذ ما أستطيع، لا ما أقول: ربط اللغة بقدرات الروبوت الفعلية2022في السماء ✦