SummFlow 2026-06-27 Hugging Face

Ornith-1.0-9B (DeepReinforce)

自改进编码代理模型,9B 单卡部署

入选理由
专为 agentic coding 优化的推理模型,9B 单卡可跑,支持工具调用和长上下文(256K),通过 vLLM/SGLang 快速部署为 OpenAI 兼容服务,适合本地编码助手场景。
对位
对位 Qwen3.5-9B / Gemma4-12B
适合
编码代理(SWE-bench) / 工具调用与终端任务
不适合
长文本创作与通用推理
规模
9B · 256k · Q4 ~5GB / FP16 ~18GB
授权
MIT · 需自查
框架
vllm / sglang / transformers / llama.cpp / ollama
工具调用
OpenAI-style (Qwen3 XML)
血统
微调自 Qwen3.5-9B
可信度
自改进 RL 训练,SWE-bench Verified 69.4%,支持 OpenAI 兼容工具调用

仅 safetensors · 无 pickle 加载风险

社区实测

9B模型便于本地部署且基准成绩亮眼,但实际编码任务中表现不佳,无工具环境下幻觉严重

  • 可在本地或边缘设备上部署
  • 在SWE-Bench Verified上得分69.4,超过部分更大模型
  • 实际编码任务中表现不佳,仅发现几乎所有模型都能发现的bug
  • 无工具环境的对话中幻觉严重
  • 会幻觉工具调用及其输出

截至 2026-07-08

快速上手

llama-server -hf deepreinforce-ai/Ornith-1.0-9B-GGUF -c 262144