Compute-Efficient Training
التدريب الأمثل حوسبياً
استراتيجية تدريب تُعظِّم الأداء ضمن ميزانية حوسبية ثابتة. وفقاً لقوانين التوسعة، يعني هذا تدريب نماذج كبيرة جداً لوقت قصير مع الإيقاف قبل التقارب.
A training strategy that maximizes performance within a fixed compute budget. According to scaling laws, this means training very large models for a short time, stopping before convergence.
Also translated asالتدريب الكفوء حوسبياً، التدريب المُثلى حوسبياً
First appears in this corpus in: ELECTRA: Pre-Training Text Encoders as Discriminators Rather Than Generators (2020)
Appears in these papers