الذكاء الاصطناعي الدستوري
Constitutional AI
منهجية لتدريب أنظمة الذكاء الاصطناعي على عدم الإيذاء باستخدام مجموعة مبادئ مكتوبة بلغة طبيعية (دستور) بدلاً من تصنيفات بشرية، عبر النقد الذاتي والتنقيح وتوليد تصنيفات التفضيل آلياً.
A method for training AI systems to be harmless using a set of natural-language principles (a constitution) instead of human labels, through self-critique, revision, and AI-generated preference labels.
تُرجم أيضاًAI الدستوري، الذكاء الدستوري، المحاذاة بالمبادئ، المواءمة الذاتية الموجهة بدستور نظامي، ضبط السلوك بناءً على قواعد ومبادئ مكتوبة، منهجية CAI
أول ظهور في هذه المجموعة: مشكلات ملموسة في أمان الذكاء الاصطناعي (2016)
يظهر في هذه الأوراق
- مشكلات ملموسة في أمان الذكاء الاصطناعي2016في السماء ✦
- الذكاء الاصطناعي الدستوري: نحو نماذج آمنة بإشراف ذاتي مبني على مبادئ2022في السماء ✦
- توسيع نطاق النماذج اللغوية: أساليب وتحليلات ورؤى من تدريب Gopher2022في السماء ✦
- تدريب النماذج اللغوية على اتّباع التعليمات باستخدام التغذية الراجعة البشرية2022في السماء ✦
- RLAIF: توسيع التعلّم المعزَّز بتغذية راجعة آلية بدلاً من البشر2023في السماء ✦