الانتباه المتناثر الكُتَلي
Block-Sparse Attention
امتداد لـ FlashAttention يتخطى كتلاً كاملة من مصفوفة الانتباه وفق قناع تناثر محدد مسبقاً، فيحقق تسريعاً إضافياً يتناسب مع نسبة الكتل المتخطّاة.
An extension of FlashAttention that skips entire blocks of the attention matrix according to a predefined sparsity mask, yielding additional speedup proportional to the fraction of blocks skipped.
تُرجم أيضاًالانتباه المتفرق بالكتل، الانتباه الكتلي المبعثر
أول ظهور في هذه المجموعة: FlashAttention: انتباه دقيق وسريع وموفِّر للذاكرة بوعي حركة البيانات (2022)
يظهر في هذه الأوراق