R
ReForm-Eval
FudanDISC/ReForm-Eval
用于评估大型视觉语言模型 (LVLM) 能力的基准
★81stars
Python
Apache-2.0
更新: 1天前
📋 项目速览
点击展开
这是什么?安全与治理领域,基于benchmark和embodied-ai的用Python构建、开源工具
作者是谁?由 FudanDISC 团队维护,GitHub 81⭐,在 安全与治理 分类 413 个项目中排名第 341
为什么诞生?在安全与治理领域,benchmark流程长期存在效率瓶颈,FudanDISC团队用ReForm-Eval解决了embodied-ai这一关键环节。
能干什么?核心场景:gpt4、in-context-learning、instruction-following
怎么用 AI 安装?推荐使用 AI 编码助手根据 GitHub README 自动完成 pip 安装和虚拟环境配置。
🔗 github.com/FudanDISC/ReForm-Eval
🔗 github.com/FudanDISC/ReForm-Eval
标签
benchmarkembodied-aigpt4in-context-learninginstruction-followinginstruction-tuninglarge-language-modelslarge-vision-language-modelsllmmultimodalmultimodal-chain-of-thoughtpre-trainingreformulationvisual-chain-of-thought