H
hh-rlhf
anthropics/hh-rlhf
"通过人类反馈的强化学习训练有用且无害的助手"的人类偏好数据
★1.9kstars
MIT
更新: 今天
📋 项目速览
点击展开
这是什么?一个安全与治理领域的security/security工具,开源
作者是谁?由 anthropics 团队维护,GitHub 1.9K⭐,在 安全与治理 分类 413 个项目中排名第 94
为什么诞生?随着security和security在安全与治理中的普及,anthropics打造了hh-rlhf作为一站式解决方案。
能干什么?核心场景:security
怎么用 AI 安装?推荐使用 AI 编码助手根据 GitHub README 自动完成安装配置和环境搭建。
🔗 github.com/anthropics/hh-rlhf | 官网 https://arxiv.org/abs/2204.05862
🔗 github.com/anthropics/hh-rlhf | 官网 https://arxiv.org/abs/2204.05862