التسوية المسبقة
Pre-normalization
تطبيق التسوية على مدخلات كل طبقة فرعية بدلاً من مخرجاتها. يحسّن استقرار التدريب للشبكات العميقة جداً. اعتُمد في GPT-3 وLLaMA.
Applying normalization to the input of each sub-layer rather than the output. Improves training stability for very deep networks. Adopted in GPT-3 and LLaMA.
تُرجم أيضاًالتطبيع المسبق، التسوية قبل الطبقة
أول ظهور في هذه المجموعة: تسوية الطبقة (2016)
يظهر في هذه الأوراق