FoundationVision

FoundationVision/Groma

[ECCV2024] Grounded Multimodal Large Language Model with Localized Visual Tokenization

⭐ 586 ⑂ 44 Python Apache-2.0 · 2024-06-07推送
586
Watchers
0
贡献者
0
Commits
0
Releases
17
Open Issues
2024-06-07
最近推送
原文 中文
暂无 README