gokayfem

gokayfem/awesome-vlm-architectures

Curated visual catalog of 155+ vision-language model (VLM/MLLM) architectures: papers, diagrams, training recipes, datasets, and a release timeline for multimodal AI agents.

⭐ 1.3k ⑂ 55 Markdown CC0-1.0 · 22 天前推送
1.3k
Watchers
0
贡献者
0
Commits
0
Releases
0
Open Issues
22 天前
最近推送
原文 中文
暂无 README