Anthropic / hh-rlhf
人类偏好数据,标注有用性与无害性,用于RLHF奖励模型训练
关键规格
HF 热度34,769 下载 · 1,999 收藏观测于 2026-08-20
源仓库更新2023-05-26
仓库许可不等于数据内容权利已全部清理,商用仍需核对数据来源、隐私与版权条款。
采用判断
项目资料与外部反馈 · 4 个来源 · 核验于 2026-07-22
仓库标注 MIT 许可但与 README“仅限研究用途”的声明存在冲突,使用前需核查许可约束;同时数据集存在标注噪声问题,不适合直接用于高精度训练。[2][4]
采用前注意
本段综合依据
- Anthropic/hh-rlhf · Datasets at Hugging Face ↗huggingface.co
- 📄 Hh Rlhf ↗unitxt.ai
- GitHub - anthropics/hh-rlhf: Human preference data for "Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback" · GitHub ↗github.com
- Anthropic/hh-rlhf · A few issues found in this dataset ↗huggingface.co