此页是 2026-06-07 的观测快照,查看该模型当前信息 → /m/lmstudio-community__gemma-4-e2b-it-qat-gguf/

归档 / 2026-06-07 / Gemma-4-E2B-it (Google)

Gemma-4-E2B-it (Google)

Gemma 4 2B 指令 GGUF,本地推理

入选理由
这个模型是 Google Gemma 4 的 GGUF 量化版,可直接在 LM Studio 或 llama.cpp 本地运行,适合低资源部署,无需自写推理代码。
对位
替代 Gemma 2 2B / Llama 3.2 3B
适合
本地指令跟随 / 移动/边缘设备推理
不适合
长上下文任务
规模
2B · 未知
授权
apache-2.0 · 可商用
框架
llama.cpp / LM Studio
血统
量化自 gemma-4-E2B-it-qat-q4_0-unquantized
可信度
Google 发布,Apache-2.0 许可证

社区实测

Gemma 4 E2B 是 Google 迄今最小的开源多模态模型(2.3B 有效参数),以 Apache 2.0 发布,原生支持文本/图像/视频/音频,主打边缘设备部署;社区已快速推出 GGUF 量化版和无审查版,但安全对齐在发布后极短时间内即被攻破。

  • 原生多模态(文本、图像、视频、音频)集成在一个 2B 级别模型中
  • Apache 2.0 许可,允许商用,无使用限制
  • 可在边缘设备 NPU 上运行,适合端侧部署
  • 发布首日即支持 llama.cpp、Ollama、LM Studio 等主流本地工具链
  • 社区已提供无审查(uncensored)GGUF K_P 量化版本
  • 参数量极小(2.3B 有效参数/5.1B 含嵌入),适合低资源本地运行
  • 安全对齐极易被绕过——Heretic 的 ARA 方法在官方发布后仅 90 分钟即成功攻破拒绝机制
  • 上下文窗口仅 128K,小于同系列大模型的 256K

截至 2026-06-21

快速上手

llama.cpp: ./llama-cli -m <gguf-file>

评分详情

Q1
今天能接上用吗   5 / 5
Q2
有可信证据吗   1 / 5
Q3
是新东西吗   1 / 5
总分
7

HuggingFace 原始数据 (抓取于 2026-06-07)

作者
lmstudio-community
任务类型
unknown
推理库
未指定
下载
314
点赞
0
许可证
apache-2.0
标签
gguf, base_model:google/gemma-4-E2B-it-qat-q4_0-unquantized, base_model:quantized:google/gemma-4-E2B-it-qat-q4_0-unquantized, license:apache-2.0, endpoints_compatible, region:us, conversational

探索

源链接