التعلُّم المعزز من التغذية الراجعة من الذكاء الاصطناعي
RLAIF
تقنية تستخدم نموذج ذكاء اصطناعي مُسترشداً بمبادئ دستورية لتوليد تصنيفات التفضيل التي تُدرِّب نموذج المكافأة، بدلاً من الاعتماد على مُصنِّفين بشريين.
Reinforcement Learning from AI Feedback — using an AI model guided by constitutional principles to generate preference labels that train a reward model, instead of relying on human annotators.
تُرجم أيضاًRLAIF، التعلم المعزز بتغذية راجعة ذاتية
أول ظهور في هذه المجموعة: الذكاء الاصطناعي الدستوري: نحو نماذج آمنة بإشراف ذاتي مبني على مبادئ (2022)
يظهر في هذه الأوراق