سلامة الذكاء الاصطناعي
AI Safety
الأبحاث المنهجية المعنية بكبح مخاطر الذكاء الاصطناعي التشغيلية والوجودية وضمان بقائه تحت السيطرة البشرية الآمنة.
AI Safety
تُرجم أيضاًمجال كبح المخاطر الوجودية والتشغيلية للنماذج، الوقاية المنهجية من الانحرافات الحوسبية
أول ظهور في هذه المجموعة: مشكلات ملموسة في أمان الذكاء الاصطناعي (2016)
يظهر في هذه الأوراق
- أمان الذكاء الاصطناعي عبر المناظرة2018في السماء ✦
- مشكلات ملموسة في أمان الذكاء الاصطناعي2016في السماء ✦
- هل القدرات الناشئة في النماذج اللغوية الكبيرة مجرد سراب؟2023في السماء ✦
- Gemma: نماذج مفتوحة الأوزان مبنية على أبحاث وتقنيات Gemini2024في السماء ✦
- LIMA: القليل يكفي للمواءمة2023في السماء ✦
- اختبار الفريق الأحمر للنماذج اللغوية للحدّ من أضرارها: المنهجيات وأنماط التوسّع والدروس المستفادة2022في السماء ✦