模型 / NuExtract3 (NuMind)

NuExtract3 (NuMind)

文档结构化提取和Markdown转换的4B视觉语言模型

作者 numind

仓库标识numind/NuExtract3

显存未知许可 可商用任务 视觉理解最近核对 2026-08-09
运行内存
权重格式未知,无法估算显存
运行时
VLLM
下载
1,720

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

快速上手示例

vllm serve numind/NuExtract3 --trust-remote-code --limit-mm-per-prompt '{"image": 99, "video": 0}'

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
有HF Space和vLLM接口可即用;本质为微调改进。
对位
对位Qwen3.5-4B、Gemma-4-E4B等小型文档VLM
适合
发票/合同/表格等文档JSON结构化提取 / 图片/扫描PDF转Markdown供RAG使用
不适合
通用图像问答或纯文本生成

独立证据与社区反馈

2 个独立来源最近验证 2026-08-09

轻量开源的结构化抽取模型,适合自部署场景,但微调灵活性不足,生产级数据管道中难以持续迭代

  • 以 4B 小参数规模提供可自托管的文本到 JSON 结构化抽取能力
  • Apache-2.0 开源许可,便于集成和商用
  • 进一步微调可能覆盖模型已有的专用抽取能力,二进制权重发布方式不利于需要持续重训的生产管道

可信度内部600样本benchmark结构提取均分0.651,超Gemma-4-E4B-it(0.538)与Qwen3.5-4B(0.417)

完整规格

规模
4B · 131k · 权重格式未知,无法估算显存
授权
Apache-2.0 · 可商用
框架
vllm / transformers
血统
微调自 Qwen3.5-4B
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 94.1k → 68.7k · likes +31

观测时间线

模型家族

查看全部家族 →