模型 / Granite-4.1-30B (IBM)

Granite-4.1-30B (IBM)

IBM Granite 30B GGUF量化, 本地部署与推理

作者
lmstudio-community
对位
对位Qwen2.5-32B等30B级开源模型
适合
本地推理与微调基线 / 通用文本生成与对话
不适合
需高精度、无损推理的任务
入选理由
有GGUF格式可直接运行;仅量化重打包,非新模型。
规模
30B · 最低 ~18GB · 4-bit(估算)
授权
Apache 2.0 · 可商用
框架
llama.cpp / LM Studio
血统
量化自 granite-4.1-30b
国内访问
需代理
可信度
HF下载量982, 基于IBM Granite官方模型, Apache 2.0许可, llama.cpp b8994量化

社区实测

安全合规与 Apache 2.0 许可构成差异化优势,但 30B 版本在社区讨论中明显被 Qwen3.6/Gemma4 等同期模型抢走关注,缺乏 reasoning 是主要短板。

  • 适合对安全合规有要求的企业场景,输出风格友好、风险更低
  • Apache 2.0 许可搭配企业级知识产权赔偿,降低商用法律风险
  • Dense 架构在 30B 级别被部分用户偏好,训练效率显著高于同代 Gemma 4
  • 配套 Granite Guardian 在 harm detection / guardbench 上表现突出
  • 30B 版本社区讨论度低,被 Qwen3.6 与 Gemma4 等同期模型抢走关注
  • 当前版本不支持 reasoning,官方表示后续版本才会加入

截至 2026-06-19

本形态 ~18GB 4-bit · 国内 需代理 · 982 下载

快速上手

llama.cpp: huggingface-cli download lmstudio-community/granite-4.1-30b-GGUF --include '*.gguf' --local-dir . && ./llama-cli -m <file>

本形态源 ↗

下载动量

30天下载 3k → 2.8k

观测时间线