Disentangled Graph Variational Auto-Encoder for Multimodal Recommendation with Interpretability, IEEE TMM
Collects a multimodal dataset of Wikipedia articles and their images
Learning Adaptive Fusion Bank for Multi-modal Salient Object Detection
[ACL 2023] VSTAR is a multimodal dialogue dataset with scene and topic transition information
SCoRe: Training Language Models to Self-Correct via Reinforcement Learning
Source code of CIKM2021 Paper 'Pre-training for Ad-hoc Retrieval: Hyperlink is Also You Need'
Automated Drowning Detection: A repository showcasing a deep learning-based solution using YOLO v8 architecture for swift and accurate identification of drowning instances in aquatic environments. Enhanced accuracy through meticulous fine-tuning and integrated methodologies. Empowering drowning incident response systems for improved efficiency.
共 40707 条 · 第 1990 / 2036 页