محوّل التنبؤ الكثيف
DPT
بنية مفكّك تستخدم محوّلات الرؤية لدمج السمات من طبقات متعدّدة وإنتاج تنبؤات كثيفة بدقة البكسل، مثل خرائط العمق أو التقطيع الدلالي.
A decoder architecture that uses Vision Transformers to fuse features from multiple layers and produce dense pixel-level predictions, such as depth maps or semantic segmentation.
تُرجم أيضاًDPT