FoundationVision/Groma
[ECCV2024] Grounded Multimodal Large Language Model with Localized Visual Tokenization
⭐ 586
⑂ 44
Python
Apache-2.0
· 2024-06-07推送
586
Watchers
0
贡献者
0
Commits
0
Releases
17
Open Issues
2024-06-07
最近推送
原文
中文
暂无 README