التحسين الذاتي
Self-Improvement
نموذج تدريبي يُحسِّن فيه الذكاء الاصطناعي مخرجاته بنقدها وتنقيحها بنفسه وفقاً لمبادئ محددة، بدلاً من الاعتماد كلياً على تغذية راجعة خارجية من مُقيِّمين بشريين.
A training paradigm where the AI improves its own outputs by critiquing and revising them according to specified principles, rather than relying entirely on external feedback from human evaluators.
تُرجم أيضاًالتحسُّن الذاتي، التعلُّم الذاتي التصحيحي
أول ظهور في هذه المجموعة: مقترح مشروع دارتموث الصيفي للبحث في الذكاء الاصطناعي (1956)
يظهر في هذه الأوراق
- الذكاء الاصطناعي الدستوري: نحو نماذج آمنة بإشراف ذاتي مبني على مبادئ2022في السماء ✦
- الذكاء الاصطناعي الدستوري: نحو نماذج آمنة بإشراف ذاتي مبني على مبادئ2022في السماء ✦
- مقترح مشروع دارتموث الصيفي للبحث في الذكاء الاصطناعي1956في السماء ✦
- RLAIF: توسيع التعلّم المعزَّز بتغذية راجعة آلية بدلاً من البشر2023في السماء ✦
- RLAIF: توسيع التعلّم المعزَّز بتغذية راجعة آلية بدلاً من البشر2023في السماء ✦
- STaR: تمهيد الاستدلال بالاستدلال2022في السماء ✦