模型 / Granite-4.1-8B-GGUF (IBM)

Granite-4.1-8B-GGUF (IBM)

IBM Granite 4.1 8B的GGUF量化,用于本地推理

作者 lmstudio-community

仓库标识lmstudio-community/granite-4.1-8b-GGUF

显存未知许可 可商用任务 文本生成最近核对 2026-08-09
运行内存
权重格式未知,无法估算显存
运行时
llama.cpp
下载
1,015

Hugging Face 源仓库 ↗

适合与不适合

入选理由
GGUF格式可直接运行;本质是量化重打包。
对位
对位 Llama-3.1-8B
适合
本地CPU推理 / 低资源设备文本生成
不适合
高并发生产环境

独立证据与社区反馈

3 个独立来源最近验证 2026-08-09

社区认为 Granite 4.1 8B 作为轻量级模型在简单任务上可用,训练数据较新是加分项,但整体能力仍不及同期的 Qwen 等模型。

  • 代码自动补全等轻量小任务
  • agentic 场景中简单工具调用的轻量级 fallback
  • 企业自托管场景中因 IBM 品牌带来的合规审批优势
  • 综合能力不如 Qwen3.6 等同期的社区冠军模型,仅适合作为辅助而非主力
  • 定位为轻量 fallback,不适合复杂任务

可信度HF下载1015,由LM Studio使用llama.cpp b8994量化

完整规格

规模
8B · 权重格式未知,无法估算显存
授权
apache-2.0 · 可商用
框架
llama.cpp / LM Studio / ollama
血统
量化自 granite-4.1-8b
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 3.6k → 3.4k

观测时间线