数据集 / Anthropic / hh-rlhf

Anthropic / hh-rlhf

人类偏好数据,标注有用性与无害性,用于RLHF奖励模型训练

HF 源仓库 ↗本站资料更新 2026-08-20

关键规格

作者
Anthropic
规模
16.9万行 · 291 MB
模态
文本
授权
mit · 许可标注允许商用
HF 热度34,769 下载 · 1,999 收藏观测于 2026-08-20
源仓库更新2023-05-26

仓库许可不等于数据内容权利已全部清理,商用仍需核对数据来源、隐私与版权条款。

采用判断

项目资料与外部反馈 · 4 个来源 · 核验于 2026-07-22

仓库标注 MIT 许可但与 README“仅限研究用途”的声明存在冲突,使用前需核查许可约束;同时数据集存在标注噪声问题,不适合直接用于高精度训练。[2][4]

采用前注意

  • 数据集在 Hugging Face 标注为 MIT 许可,但 README 及 GitHub 仓库页均明确声明“数据仅供研究用途(intended for research purposes)”,许可证与实际使用限制存在矛盾。[1][2]
  • 数据集中的标注存在噪声,部分被标注为“rejected”的回复实际上优于“chosen”的回复。[4]

历史记录

7 次历史卡片 · 2026-05-22 至 2026-08-20