الإشراف القابل للتوسُّع
Scalable Oversight
تقنيات تُسخِّر أنظمة الذكاء الاصطناعي لمساعدة البشر في الإشراف على أنظمة ذكاء اصطناعي أخرى، مما يُخفِّف من عنق زجاجة التصنيف البشري مع ازدياد قدرة النماذج.
Techniques that leverage AI systems to help humans supervise other AIs, reducing the bottleneck of human annotation as models become more capable.
تُرجم أيضاًالرقابة القابلة للتوسع، الإشراف المُتدرِّج
أول ظهور في هذه المجموعة: مشكلات ملموسة في أمان الذكاء الاصطناعي (2016)
يظهر في هذه الأوراق
- أمان الذكاء الاصطناعي عبر المناظرة2018في السماء ✦
- مشكلات ملموسة في أمان الذكاء الاصطناعي2016في السماء ✦
- الذكاء الاصطناعي الدستوري: نحو نماذج آمنة بإشراف ذاتي مبني على مبادئ2022في السماء ✦
- الذكاء الاصطناعي الدستوري: نحو نماذج آمنة بإشراف ذاتي مبني على مبادئ2022في السماء ✦
- التعميم من الضعيف إلى القوي: استخراج القدرات القوية بإشراف ضعيف2023في السماء ✦