RLAIF
التعلُّم المعزز من التغذية الراجعة من الذكاء الاصطناعي
تقنية تستخدم نموذج ذكاء اصطناعي مُسترشداً بمبادئ دستورية لتوليد تصنيفات التفضيل التي تُدرِّب نموذج المكافأة، بدلاً من الاعتماد على مُصنِّفين بشريين.
Reinforcement Learning from AI Feedback — using an AI model guided by constitutional principles to generate preference labels that train a reward model, instead of relying on human annotators.
Also translated asRLAIF، التعلم المعزز بتغذية راجعة ذاتية
First appears in this corpus in: Constitutional AI: Harmlessness from AI Feedback (2022)
Appears in these papers