模型 / Harness-1 (pat-jj)

Harness-1 (pat-jj)

20B搜索智能体,对标前沿检索性能

作者 pat-jj

~13GB 4-bit许可 需自查任务 文本生成最近核对 2026-07-22
格式
4-bit
文件
~11GB
运行内存
~13GB–16GB
运行时
transformers
下载
902

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

适合与不适合

入选理由
20B搜索agent,基于GPT-OSS微调,具备前沿搜索能力;需自写vLLM推理代码,适合有GPU资源的开发者。
对位
对标前沿AI搜索能力,替代闭源搜索方案
适合
检索增强生成 (RAG) / 知识密集型问答与搜索
不适合
无检索需求的纯文本生成

独立证据与社区反馈

4 个独立来源 · 另 1 官方/转载最近验证 2026-07-22

状态化搜索 harness 在检索召回指标上确实有效,但实际效果高度依赖模型调优,各类 harness 实现之间差异不明确。

  • 提升检索召回率:移除所有 harness 机制后召回率相对下降 12.2%
  • 在 8 个基准上平均 curated recall 达 0.730,比最强的开源子代理高 11.4 个百分点
  • 在未见过基准上增益更大(+17.0 vs +7.9 点),搜索操作具备迁移能力
  • harness 效果受限于模型调优,prompt 结构和特殊 token 配置不当会带来糟糕体验
  • bagels 在 HN 讨论中指出存在 prompt 注入风险
  • 社区对各类 harness 的差异化难以判断,选择缺乏客观基准,被 Reddit 用户形容为类似「Broscience」

可信度HF下载量902,点赞72,论文 arXiv:2606.02373 与代码公开

完整规格

规模
20B · 下载 ~11GB · 显存最低 ~13GB · 推荐 ~16GB · 4-bit(估算)
商用
需自查
框架
transformers / vllm / tinker
血统
微调自 gpt-oss-20b
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 2.8k → 1.5k · likes +5

观测时间线

模型家族

查看全部家族 →