数据集 / nvidia / Nemotron-Personas-El-Salvador

nvidia / Nemotron-Personas-El-Salvador

萨尔瓦多西班牙语合成人格数据,基于真实分布

HF 源仓库 ↗本站资料更新 2026-06-06

关键规格

作者
nvidia
规模
14.8万行 · 1.1 GB
模态
文本
任务
文本生成
授权
cc-by-4.0 · 许可标注允许商用
语种
es
HF 热度1,427 下载 · 31 收藏观测于 2026-06-06
源仓库更新2026-06-05

仓库许可不等于数据内容权利已全部清理,商用仍需核对数据来源、隐私与版权条款。

采用判断

独立证据与社区反馈 · 3 个来源 · 核验于 2026-07-23

纯合成、地域单一的萨尔瓦多人设数据集,采用范围受限于其合成性质和地理覆盖

采用前注意

  • 该数据集完全由合成生成(synthetically-generated personas),合成数据可能存在事实偏差或与现实分布不一致的问题
  • 数据集仅涵盖萨尔瓦多的人口、地理和人格特质分布,超出该地区的适用性有限
  • 社区反馈指出 Nemotron 系列模型存在'benchmaxed'现象,即针对基准测试过度优化,实际使用效果可能不如基准分数所示
  • Nvidia 的开源策略被社区认为旨在为其专有技术栈构筑护城河,长期维护和生态独立性存疑

历史记录

1 次历史卡片 · 2026-06-06