← 返回专题广场
vision-language-learning
4 个项目 · ⭐ 2.5k1
A novel Multimodal Large Language Model (MLLM) architecture, designed to structurally align visual and textual embeddings.
Python
⭐ 1.5k
⑂ 89
Apache-2.0
· 2026-07-15推送
2026-07-15
最近推送
2
[CVPR'25 highlight] RLAIF-V: Open-Source AI Feedback Leads to Super GPT-4V Trustworthiness
Python
⭐ 459
⑂ 19
· 2025-05-14推送
2025-05-14
最近推送
3
2024-08-24
最近推送
4
2025-07-09
最近推送