netflix / Vera-Layered-Video-Dataset
用于分层扩散视频编辑的内容保持视频数据集
仓库许可不等于数据内容权利已全部清理,商用仍需核对数据来源、隐私与版权条款。
项目方资料核对
训练集合成数据占比极高(约 87.7%),且测试集与训练集同源,存在明显的测试集泄漏风险,采用前需谨慎评估合成数据对真实场景的泛化能力。
- 用于视频编辑模型(如背景替换、物体添加)的合成数据训练与评估
- 训练集约 87.7% 为合成数据(synthetic-bg-change 及 synthetic-obj-add 共 9,842 条),真实数据仅约 12.3%(共 1,384 条),以合成数据为主的训练集可能导致模型在真实视频上泛化不足
- 测试集明确标注来自训练集同源数据('The test set is sourced from the training sources above'),无法独立评估模型在未见数据上的表现,存在测试集泄漏风险
截至 2026-07-22