CodeDevX / Vibe-Coding-Instruct
数据集描述为空,内容不详。
仓库许可不等于数据内容权利已全部清理,商用仍需核对数据来源、隐私与版权条款。
项目资料与外部反馈
数据集由约 10 种场景模板大规模重复填充至 1.1M 行,行间仅场景编号不同,实际信息密度极低,采用前需评估模板化数据对训练的价值。
- 数据集 1.1M 行中仅约 10 种场景模板反复循环(如 "React app re-renders infinitely"、"Deploy an AI application"、"Create a coding assistant" 等),每条输出的尾部均为 "Include milestones, technology choices, risks, testing strategy, and scaling considerations." 固定句式,大量行间仅场景编号不同,实质差异极小。
- 数据集内容为全合成 instruction-response 对,AI 生成代码的版权保护需依赖可证明的人类创造性贡献,若无法证明则存在版权归属不确定性。
来源
CodeDevX/Vibe-Coding-Instruct · Datasets at Hugging FaceAI-generated code and vibe coding: copyright, licensing, and legal risks - d&a partners
截至 2026-07-22