vision
81 个项目 · ⭐ 227.7kXVO: Generalized Visual Odometry via Cross-Modal Self-Training [ICCV 2023]
YesBut - Multimodal Satire Comprehension Dataset
(WACV'24) Kaizen: Practical self-supervised continual learning with continual fine-tuning
Multimodal AI Assistant is an advanced chatbot designed for local interactions with LLMs, files, and multimodal functionalities. Built on the Chainlit framework, it integrates Langchain and ChatOllama for hosting models locally, with cloud storage and monitoring via LiteralAI.
Streamlit app for 3D semantic segmentation of intra-oral teeth scans with MeshSegNet
Characterize Anything: A Wondrous Chemical Reaction between vision models and AI Characters
A WebML based Vision-Language App that Roasts you like an Asian Mom
Claude Code hook toolkit that gives vision-blind models a text description of pasted/tool-produced images.
共 81 条 · 第 4 / 5 页