In response to the inefficiency of the vector concatenation-based multi-modal classification model and the neglect of single-modal information in multi-modal classification models, we propose a new multi-modal classification model that employs a multi-modal information fusion method based on attention mechanism. This model can effectively improve classification accuracy and utilize single-modal information for auxiliary classification. The model demonstrates good performance in experiments, proving its feasibility and effectiveness in multi-modal classification tasks.

Multi-Modal Classification Model with Attention-Based Fusion for Enhanced Accuracy

原文地址: https://www.cveoy.top/t/topic/mYZU 著作权归作者所有。请勿转载和采集!

免费AI点我,无需注册和登录