المعجم

توازي البيانات

Data Parallelism

استراتيجية تدريب تُوزّع دُفعات البيانات على عدة وحدات معالجة رسومية، كل منها تحتفظ بنسخة من النموذج وتُجمع التدرجات بعد كل خطوة. تُستخدم مع توازي النموذج في تدريب LLaMA.

A training strategy that distributes data batches across multiple GPUs, each holding a copy of the model and aggregating gradients after each step. Used alongside model parallelism in LLaMA training.

تُرجم أيضاًالتوازي في البيانات، توزيع مصفوفات البيانات عبر المعالجات، معالجة البيانات بالتوازي، معالجة حزم المدخلات المختلفة بالتزامن

أول ظهور في هذه المجموعة: Deep Speech 2: التعرّف الشامل على الكلام في الإنجليزية والصينية (2015)

يظهر في هذه الأوراق