此页是 2026-06-27 的观测快照,查看该模型当前信息 → /m/deepreinforce-ai__ornith-10-9b/

归档 / 2026-06-27 / Ornith-1.0-9B (DeepReinforce)

Ornith-1.0-9B (DeepReinforce)

自改进编码代理模型,9B 单卡部署

入选理由
专为 agentic coding 优化的推理模型,9B 单卡可跑,支持工具调用和长上下文(256K),通过 vLLM/SGLang 快速部署为 OpenAI 兼容服务,适合本地编码助手场景。
对位
对位 Qwen3.5-9B / Gemma4-12B
适合
编码代理(SWE-bench) / 工具调用与终端任务
不适合
长文本创作与通用推理
规模
9B · 256k · Q4 ~5GB / FP16 ~18GB
授权
MIT · 需自查
框架
vllm / sglang / transformers / llama.cpp / ollama
工具调用
OpenAI-style (Qwen3 XML)
血统
微调自 Qwen3.5-9B
可信度
自改进 RL 训练,SWE-bench Verified 69.4%,支持 OpenAI 兼容工具调用

仅 safetensors · 无 pickle 加载风险

社区实测

9B模型便于本地部署且基准成绩亮眼,但实际编码任务中表现不佳,无工具环境下幻觉严重

  • 可在本地或边缘设备上部署
  • 在SWE-Bench Verified上得分69.4,超过部分更大模型
  • 实际编码任务中表现不佳,仅发现几乎所有模型都能发现的bug
  • 无工具环境的对话中幻觉严重
  • 会幻觉工具调用及其输出

截至 2026-07-08

快速上手

llama-server -hf deepreinforce-ai/Ornith-1.0-9B-GGUF -c 262144

评分详情

Q1
今天能接上用吗   5 / 5
Q2
有可信证据吗   1 / 5
Q3
是新东西吗   4 / 5
总分
10

HuggingFace 原始数据 (抓取于 2026-06-27)

作者
deepreinforce-ai
任务类型
text-generation
推理库
transformers
下载
218
点赞
110
许可证
MIT
标签
transformers, safetensors, qwen3_5, image-text-to-text, text-generation, conversational, license:mit, eval-results, endpoints_compatible, region:us

探索

源链接