BIG-Bench
BIG-Bench
مجموعة معايير واسعة النطاق تضم أكثر من 200 مهمة جُمعت بشكل تعاوني لتقييم النماذج اللغوية الكبيرة، تشمل مهام حسابية ولغوية ومنطقية متنوعة.
A large-scale crowd-sourced benchmark suite of over 200 tasks for evaluating large language models, including arithmetic, linguistic, and logical reasoning tasks.
تُرجم أيضاًمعيار BIG-Bench، مجموعة BIG-Bench
أول ظهور في هذه المجموعة: القدرات الناشئة في النماذج اللغوية الكبيرة (2022)
يظهر في هذه الأوراق