The creative suite for character-driven AI experiences.
TaiSu(太素)--a large-scale Chinese multimodal dataset(亿级大规模中文视觉语言预训练数据集)
[CVPR2020] Unsupervised Multi-Modal Image Registration via Geometry Preserving Image-to-Image Translation
The official code of "VL-Rethinker: Incentivizing Self-Reflection of Vision-Language Models with Reinforcement Learning" [NeurIPS25]
OpenAPI(Swagger) specification of Twitter Internal API (Twitter graphql API)
Python SDK for interacting with the MCP Toolbox for Databases.
Kubernetes driver extension of the Chaos Toolkit probes and actions API
A codebase that makes differentially private training of transformers easy.
工程化 RAG 文档助手:知识库、PDF 索引、Agent 工具编排、scope 检索、引用溯源与拒答阈值。FastAPI + Vue3
Open-source tools for training and evaluating Vision Language Models for OCR
A Django + Vue reference project that focuses on developer tooling and CI/CD + IaC
[ICCV25 Oral] Token Activation Map to Visually Explain Multimodal LLMs
共 9100 条 · 第 282 / 455 页