V
verl-agent
langfengQ/verl-agent
verl-agent是veRL的扩展,专为通过强化学习训练LLM/VLM代理而设计。verl-agent也是论文《Group-in-Group Policy Optimization for LLM Agent Training》的官方代码。
★2.2kstars
Python
Apache-2.0
更新: 今天
📋 项目速览
点击展开
这是什么?智能体领域,基于agent-framework和deepseek-r1的用Python构建、开源工具
作者是谁?由 langfengQ 团队维护,GitHub 2.2K⭐,在 智能体 分类 2166 个项目中排名第 567
为什么诞生?在智能体领域,agent-framework流程长期存在效率瓶颈,langfengQ团队用verl-agent解决了deepseek-r1这一关键环节。
能干什么?核心场景:gigpo、grpo、large-language-models
怎么用 AI 安装?推荐使用 AI 编码助手根据 GitHub README 自动完成 pip 安装和虚拟环境配置。
🔗 github.com/langfengQ/verl-agent | 官网 https://huggingface.co/papers/2505.10978
🔗 github.com/langfengQ/verl-agent | 官网 https://huggingface.co/papers/2505.10978
标签
agent-frameworkdeepseek-r1gigpogrpolarge-language-modelsllm-agentsllm-trainingreinforcement-learning