Gemma-4-E2B-it (Google)
Gemma 4 2B 指令 GGUF,本地推理
仓库标识lmstudio-community/gemma-4-E2B-it-QAT-GGUF
显存未知许可 可商用最近核对 2026-08-05
链接指向的配置 不在本页收录的形态里,已显示默认形态(GGUF)。
- 运行内存
- 权重格式未知,无法估算显存
- 运行时
- llama.cpp
- 下载
- 314
适合与不适合
独立证据与社区反馈
Gemma 4 E2B 是一款 2B 参数的小模型,在 8GB 手机端即可本地运行,部署门槛低(Ollama/LiteRT-LM 一行命令),对齐强度明显弱于 Gemma 3、更容易去审查;但工具调用/搜索极懒、对 system prompt 非常敏感且回答偏短,不要期望其能力超过 7B 级别。
- 2B 参数即可在 8GB 安卓手机端本地运行,适合移动设备与笔记本
- 通过 Ollama `ollama pull gemma4:e2b` 或 `uvx litert-lm run` 一行命令即可快速部署
- 支持文本、图像、音频多模态输入
- 相比 Gemma 3 对齐强度明显降低,去审查/消除拒答几乎不需要额外处理
- 不再出现 Gemma 3 的 massive activation 问题,去审查时不再需要 Winsorization 等 hack
- 支持 JSON 结构化输出
- 提供 GGUF 格式及 K_P 量化,方便本地推理
- 可用 ARA(Arbitrary-Rank Ablation)方法进一步去除安全对齐
- 工具调用/网页搜索方面非常懒惰,默认不搜索,即使显式要求也仅做单次搜索、扫一眼摘要就停止
- 对 system prompt 极其敏感,需严格逐字指导,否则会按字面理解而缺乏意图推断
- 回答偏短,在需要详细回复的场景下可能不充分
- 作为 2B 模型,不要期望其性能超过 7B 级别
- 去审查版本在长上下文场景下未经充分手动测试,可能存在边缘情况
- 社区实测Google releases Gemma 4 open models
- 社区实测Gemma 4 E4B + E2B Uncensored (Aggressive) — GGUF + K_P Quants (Multimodal: Vision, Video, Audio) : r/LocalLLaMA
- 社区实测Gemma 4 E2B runs surprisingly well on my 8GB Android ...
- 社区实测p-e-w/gemma-4-E2B-it-heretic-ara: ...
- 社区实测Gemma 4 - lazy model or am I crazy? (bit of a rant)
- 独立评测Use Gemma open models | Gemini Enterprise Agent Platform
可信度Google 发布,Apache-2.0 许可证
完整规格
下载动量
30天下载 2.9k → 2.8k · likes +1