OpenGVLab/InternVideo
[ECCV2024] Video Foundation Models & Data for Multimodal Understanding
⭐ 2.4k
⑂ 159
Python
Apache-2.0
· 2026-07-02推送
benchmarkcontrastive-learningfoundation-modelsinstruction-tuningmultimodalvision-transformerzero-shot-retrievalzero-shot-classificationself-supervisedvideo-understandingvideo-question-answeringvideo-retrievalaction-recognitionmasked-autoencoderopen-set-recognitionspatio-temporal-action-localizationtemporal-action-localizationvideo-clipvideo-datavideo-dataset
2.4k
Watchers
0
贡献者
0
Commits
0
Releases
147
Open Issues
2026-07-02
最近推送
原文
中文
暂无 README