模型 / Granite-4.1-30B (IBM)

Granite-4.1-30B (IBM)

IBM Granite 30B GGUF量化, 本地部署与推理

作者 lmstudio-community

仓库标识lmstudio-community/granite-4.1-30b-GGUF

显存未知许可 可商用任务 文本生成最近核对 2026-08-09
运行内存
权重格式未知,无法估算显存
运行时
llama.cpp
下载
982

Hugging Face 源仓库 ↗

适合与不适合

入选理由
有GGUF格式可直接运行;仅量化重打包,非新模型。
对位
对位Qwen2.5-32B等30B级开源模型
适合
本地推理与微调基线 / 通用文本生成与对话
不适合
需高精度、无损推理的任务

独立证据与社区反馈

4 个独立来源最近验证 2026-08-09

社区实测反馈偏负面,同规模下被 Qwen 3.6 大幅超越,核心优势仅在于较新的训练数据截止日期。

  • 较新的训练数据截止日期,对时效敏感型任务有一定价值
  • 可作为自动补全和小型文本任务的轻量选择
  • 基准测试成绩弱,30B 的 AA Index 仅 15,与 Gemma 4 E4B 及 Qwen 3.5 2B 等小得多的模型持平
  • IBM 官方基准测试有意避开了 Qwen 3.6-35b-a3b 和 Qwen 3.6-27b,后者在该规模明显更强
  • 上一代 Granite 4 小模型推理速度偏慢且逻辑题表现不佳,部分用户快速失去兴趣

可信度HF下载量982, 基于IBM Granite官方模型, Apache 2.0许可, llama.cpp b8994量化

完整规格

规模
30B · 权重格式未知,无法估算显存
授权
Apache 2.0 · 可商用
框架
llama.cpp / LM Studio
血统
量化自 granite-4.1-30b
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 1.3k → 899

观测时间线