ginigen-ai / Metacognition-Bench评估大语言模型检测与纠正自身推理错误的元认知基准作者ginigen-ai规模300 行 · 197 KB模态文本任务文本生成 / 问答授权apache-2.0 · 许可标注允许商用语种en下载78收藏19仓库许可不等于数据内容权利已全部清理,商用仍需核对数据来源、隐私与版权条款。观测时间线2026-07-02 · 当日卡片 →