دمج النواة
Kernel Fusion
تقنية تحسين للمعالجات الرسومية تجمع عدة عمليات متتالية في نواة GPU واحدة لتقليل عبء القراءة والكتابة من الذاكرة. مامبا تدمج التمييز والمسح وضرب المُخرَج في نواة واحدة.
A GPU optimization technique that combines multiple sequential operations into a single GPU kernel to reduce memory read/write overhead. Mamba fuses discretization, scan, and output multiplication into one kernel.
تُرجم أيضاًتوحيد نوى المعالج، دمج عمليات النواة، دمج نواة المعالج، صهر النوى
أول ظهور في هذه المجموعة: FlashAttention: انتباه دقيق وسريع وموفِّر للذاكرة بوعي حركة البيانات (2022)
يظهر في هذه الأوراق
- FlashAttention-2: انتباه أسرع بتوازٍ أفضل وتوزيع عمل أذكى2023في السماء ✦
- FlashAttention: انتباه دقيق وسريع وموفِّر للذاكرة بوعي حركة البيانات2022في السماء ✦
- FlashAttention: انتباه دقيق وسريع وموفِّر للذاكرة بوعي حركة البيانات2022في السماء ✦
- مامبا: نمذجة التسلسلات في زمن خطّي باستخدام فضاءات حالة انتقائية2023في السماء ✦