فضاء الأفعال
Action Space
مجموعة كل الأفعال الممكنة التي يستطيع الوكيل تنفيذها في أي خطوة زمنية. في ReAct يُوسَّع هذا الفضاء بإضافة أفكار اللغة الطبيعية إلى جانب أفعال البيئة.
The set of all possible actions an agent can take at any given time step. In ReAct this space is augmented by adding natural language thoughts alongside environment actions.
تُرجم أيضاًمجال الأفعال، حيّز الإجراءات المتاحة
أول ظهور في هذه المجموعة: أمثَلة السياسة بمنطقة الثقة (2015)
يظهر في هذه الأوراق
- مستوى الأستاذ الأكبر في StarCraft II باستخدام التعلّم المعزّز متعدّد الوكلاء2019في السماء ✦
- اكتشاف خوارزميات أسرع لضرب المصفوفات بالتعلّم المعزَّز2022في السماء ✦
- التعلُّم المُحافِظ لدالة Q للتعلُّم المعزَّز دون اتصال2020في السماء ✦
- محوِّل القرار: التعلّم المعزَّز عبر نمذجة التسلسلات2021في السماء ✦
- سياسة الانتشار: تعلُّم السياسات البصرية-الحركية بانتشار الأفعال2023في السماء ✦
- وكيل واحد لكل المهام2022في السماء ✦
- عُد أولاً، ثم استكشِف2021في السماء ✦
- تعلُّم التلاعب البارع داخل اليد الآلية2019في السماء ✦
- MuZero: إتقان ألعاب Atari وGo والشطرنج وShogi بالتخطيط عبر نموذج مُتعلَّم2020في السماء ✦
- Open X-Embodiment: مجموعات بيانات التعلّم الروبوتي ونماذج RT-X2024في السماء ✦
- π₀: نموذج تدفُّقي للرؤية واللغة والفعل للتحكم العام بالروبوتات2024في السماء ✦
- QT-Opt: تعلُّم تعزيزي عميق قابل للتوسيع للتحكّم الآلي بالرؤية الحاسوبية2018في السماء ✦
- ReAct: دمج الاستدلال والفعل في النماذج اللغوية2023في السماء ✦
- Reflexion: وكلاء لغويون بالتعزيز اللفظي2023في السماء ✦
- RT-1: محوِّل الروبوتات للتحكم الواقعي على نطاق واسع2022في السماء ✦
- الفاعل-الناقد المَرِن: تعلُّم معزَّز عميق خارج السياسة بأقصى إنتروبيا مع فاعل عشوائي2018في السماء ✦
- نفِّذ ما أستطيع، لا ما أقول: ربط اللغة بقدرات الروبوت الفعلية2022في السماء ✦
- أمثَلة السياسة بمنطقة الثقة2015في السماء ✦
- WebArena: بيئة ويب واقعية لبناء وكلاء مستقلّين2023في السماء ✦
- نماذج العالَم2018في السماء ✦