S
safe-rlhf
PKU-Alignment/safe-rlhf
Safe RLHF:通过基于人类反馈的安全强化学习实现约束价值对齐
★1.6kstars
Python
Apache-2.0
更新: 1周前
📋 项目速览
点击展开
这是什么?开源安全与治理项目,用Python构建、核心能力在ai-safety/alpaca
作者是谁?由 PKU-Alignment 团队维护,GitHub 1.6K⭐,在 安全与治理 分类 413 个项目中排名第 95
为什么诞生?安全与治理领域快速发展,ai-safety场景缺乏高效方案,safe-rlhf应运而生,专注于简化alpaca相关工作流程。
能干什么?核心场景:beaver、datasets、deepspeed
怎么用 AI 安装?推荐使用 AI 编码助手根据 GitHub README 自动完成 pip 安装和虚拟环境配置。
🔗 github.com/PKU-Alignment/safe-rlhf | 官网 https://pku-beaver.github.io
🔗 github.com/PKU-Alignment/safe-rlhf | 官网 https://pku-beaver.github.io
标签
ai-safetyalpacabeaverdatasetsdeepspeedgptlarge-language-modelsllamallmllmsreinforcement-learningreinforcement-learning-from-human-feedbackrlhfsafe-reinforcement-learningsafe-reinforcement-learning-from-human-feedbacksafe-rlhfsafetytransformertransformersvicuna