Anthropic / hh-rlhf 人类偏好数据,用于训练帮助性和无害性奖励模型 16.9万行 · 4.1 GB 文本 mit · 可商用 下载 32k · 收藏 1.8k · 3年前更新 py from datasets import load_dataset ds = load_dataset("Anthropic/hh-rlhf") 复制