Lv1
44 积分 2024-03-08 加入
Robust Audio-Visual Question Answering with Missing Modality in Training and Testing
5天前
已完结
Incomplete Multimodal Probability Flow Recovery for Emotion Recognition
1个月前
已完结
MIDAS: Mutual Information Disentanglement With Uncertainty-Aware Fusion for Incomplete Multimodal Sentiment Analysis
1个月前
已完结
SRVC-LA: Sparse regularization of visual context and latent attention based model for video description
1个月前
已完结
MGTR-MISS: More Ground Truth Retrieving based Multimodal Interaction and Semantic Supervision for video description
1个月前
已关闭
Semantic Modulated Prompting for Few-Shot Audio-Visual Classification
4个月前
已完结
Emotional Video Captioning With Vision-Based Emotion Interpretation Network
4个月前
已完结
Emotion-Prior Awareness Network for Emotional Video Captioning
4个月前
已完结
Emotion Expression With Fact Transfer for Video Description
4个月前
已完结
CFMMC-Align: Coarse-Fine Multi-Modal Contrastive Alignment Network for Traffic Event Video Question Answering
5个月前
已完结