Koleslaw-Nemotron-30B (ThunkAboutIt)
把粗糙提示变成结构化详细提示,方便交给任意模型
仓库标识thunkaboutit/Koleslaw-Nemotron-30B-A3B-PromptEnhance
~19GB 4-bit许可 需自查任务 文本生成最近核对 2026-08-05
- 格式
- 4-bit
- 文件
- ~16GB
- 运行内存
- ~19GB–25GB
- 运行时
- OLLAMA
- 下载
- 633
仅 safetensors · 无 pickle 加载风险
快速上手示例
ollama run hf.co/thunkaboutit/Koleslaw-Nemotron-30B-A3B-PromptEnhance 依赖版本和硬件参数请以源仓库说明为准。
适合与不适合
独立证据与社区反馈
社区对 Nemotron 30B 系列评价两极,有人惊艳于其同尺寸下的智能表现,也有人反馈出错较多、一致性不如同类模型。
- 在 30B 规模下展现出超出预期的通用问题回答能力
- 幻觉测试、知识回忆、列表合并等任务表现良好,且回答简洁不冗长
- 在系统内存中推理速度约 2-3 tokens/s
- 30B 版本稳定性不足,存在较多错误
- 一致性不如 qwen3-coder 30B-A3B
- 部分用户更倾向于使用 qwen3.6 或 gemma-4
- 社区实测r/LocalLLM on Reddit: NVIDIA Nemotron — does anyone actually use it?
- 社区实测r/LocalLLaMA on Reddit: Nemotron-3-nano:30b is a spectacular general purpose local LLM
- 社区实测r/LocalLLaMA on Reddit: Don't sleep on the new Nemotron Cascade
- 社区实测r/LocalLLaMA on Reddit: Nemotron 3 Nano 30B is Amazing! (TLDR)
- 社区实测r/LocalLLaMA on Reddit: Nemotron - King of the Deep? Comparison of 4 models <=120B
可信度生产驱动 koleslaw.ai,量化效果对比(IQ4_NL vs Q8_0)及评测数据已公开
完整规格
下载动量
30天下载 1.3k → 784 · likes +1
观测时间线
模型家族
- NVIDIA-Nemotron-3-Nano-30B-A3B-BF16
- LoRA Koleslaw-Nemotron-30B (ThunkAboutIt)
- 微调 PhoneLLM Alpha 1 (Pipecat)