V
VisionReasoner
JIA-Lab-research/VisionReasoner
[ICLR 2026] VisionReasoner:通过强化学习实现统一推理集成的视觉感知
★350stars
Python
Apache-2.0
更新: 3天前
📋 项目速览
点击展开
这是什么?用Python构建、打造开源模型项目,专注counting-objects和multimodal方向
作者是谁?由 JIA-Lab-research 团队维护,GitHub 350⭐,在 模型 分类 3201 个项目中排名第 2040
为什么诞生?在模型领域,counting-objects流程长期存在效率瓶颈,JIA-Lab-research团队用VisionReasoner解决了multimodal这一关键环节。
能干什么?核心场景:multimodal-large-language-models、object-detection、reasoning-language-models
怎么用 AI 安装?推荐使用 AI 编码助手根据 GitHub README 自动完成 pip 安装和虚拟环境配置。
🔗 github.com/JIA-Lab-research/VisionReasoner
🔗 github.com/JIA-Lab-research/VisionReasoner
标签
counting-objectsmultimodalmultimodal-large-language-modelsobject-detectionreasoning-language-modelsreinforcement-learningsegmentationvisual-perception