التأريض البصري
Visual Grounding
قدرة النموذج على ربط المفاهيم اللغوية بمناطق محددة في الصورة. في VQA، التأريض يعني أن النموذج ينظر إلى المنطقة الصحيحة عند الإجابة عن سؤال حول جزء معين من المشهد.
The ability of a model to link linguistic concepts to specific regions in an image. In VQA, grounding means the model attends to the correct region when answering a question about a specific part of the scene.
تُرجم أيضاًالإرساء البصري، الربط بالمشهد
أول ظهور في هذه المجموعة: Grounding DINO: دمج DINO مع التدريب المسبق المُوجَّه لغوياً لكشف الأجسام المفتوح (2023)
يظهر في هذه الأوراق