المعجم

مرمِّز بصري

Vision Encoder

مكوِّن شبكة عصبية يحوِّل الصور الخام إلى تمثيلات سمات مهيكلة، وعادةً يكون محوِّل رؤية (ViT) أو شبكة التفافية.

A neural network component that converts raw images into structured feature representations, typically a Vision Transformer (ViT) or convolutional neural network.

تُرجم أيضاًالمرمِّز البصري، مرمِّز الرؤية

أول ظهور في هذه المجموعة: Flamingo: نموذج لغوي بصري للتعلّم بأمثلة قليلة (2022)

يظهر في هذه الأوراق