模型 / Harness-1 (pat-jj)

Harness-1 (pat-jj)

20B搜索智能体,对标前沿检索性能

作者 pat-jj

仓库标识pat-jj/harness-1

显存未知许可 需自查任务 文本生成最近核对 2026-08-05
运行内存
权重格式未知,无法估算显存
运行时
transformers
下载
902

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

适合与不适合

入选理由
20B搜索agent,基于GPT-OSS微调,具备前沿搜索能力;需自写vLLM推理代码,适合有GPU资源的开发者。
对位
对标前沿AI搜索能力,替代闭源搜索方案
适合
检索增强生成 (RAG) / 知识密集型问答与搜索
不适合
无检索需求的纯文本生成

独立证据与社区反馈

2 个独立来源 · 另 1 官方/转载最近验证 2026-08-05

Harness-1 是一个 20B 开源搜索子代理,在多项检索基准上 curated recall 领先于其他开放模型,但本身不直接回答提问,需搭配下游模型使用。

  • 在 8 个基准上平均 curated recall 达 0.730,超越次优开放子代理 11.4 个百分点
  • 在 held-out 基准上增益更大(+17.0 vs +7.9),搜索操作具有可迁移性
  • 将搜索簿记(状态管理、文档策展、验证记录)与语义决策分离,减轻模型同时充当记忆、笔记、验证等多重角色的负担
  • 模型权重和代码已公开发布,支持 vLLM、SGLang、Transformers 部署
  • Harness-1 仅返回策展文档集,不直接回答问题,需搭配下游回答模型
  • 移除 harness 机制后召回率相对下降 12.2%,性能高度依赖该基础设施

可信度HF下载量902,点赞72,论文 arXiv:2606.02373 与代码公开

完整规格

规模
20B · 权重格式未知,无法估算显存
商用
需自查
框架
transformers / vllm / tinker
血统
微调自 gpt-oss-20b
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 384 → 342 · likes +1

观测时间线

模型家族

查看全部家族 →