شبكة التغذية الأمامية المختلطة
Mix-FFN
وحدة تغذية أمامية تُدرج التفافاً بعمق 3×3 بين طبقتي MLP لتسريب معلومات الموضع المكاني ضمنياً عبر الحشو الصفري، مما يُغني عن الترميز الموضعي الصريح في المحوِّلات البصرية.
A feedforward module that inserts a 3×3 depthwise convolution between two MLP layers to implicitly leak spatial positional information through zero-padding, eliminating the need for explicit positional encoding in vision Transformers.
تُرجم أيضاًMix Feed-Forward Network، شبكة FFN المختلطة