السمّية
Toxicity
توليد النموذج لمحتوى مسيء أو ضار أو تمييزي، وهو من المقاييس الرئيسية لسلامة النماذج اللغوية الكبيرة.
Model generation of offensive, harmful, or discriminatory content — one of the key safety metrics for large language models.
تُرجم أيضاًالتوليد الضار، السمّية اللغوية، الفساد الدلالي للمخرجات، المحتوى السامّ، المحتوى الضار، توليد نصوص هجومية أو بذيئة أو تحريضية
أول ظهور في هذه المجموعة: توسيع نطاق النماذج اللغوية: أساليب وتحليلات ورؤى من تدريب Gopher (2022)
يظهر في هذه الأوراق
- توسيع نطاق النماذج اللغوية: أساليب وتحليلات ورؤى من تدريب Gopher2022في السماء ✦
- تدريب النماذج اللغوية على اتّباع التعليمات باستخدام التغذية الراجعة البشرية2022في السماء ✦
- OPT: نماذج لغوية مفتوحة مُدرَّبة مسبقاً بمعمارية المُحوِّل2022في السماء ✦
- اختبار الفريق الأحمر للنماذج اللغوية للحدّ من أضرارها: المنهجيات وأنماط التوسّع والدروس المستفادة2022في السماء ✦