此页是 2026-08-02 的观测快照,查看该模型当前信息 → /m/fermionresearch__neutrino-8b/

归档 / 2026-08-02 / Neutrino-8B (Fermion)

Neutrino-8B (Fermion)

子 2 比特 8B 聊天模型,容器 2.56 GB

入选理由
一行命令即可在 CPU 上运行的三元量化 8B 模型,基于 Qwen3-8B 压缩至 2.56GB,支持工具调用与 JSON 输出,适合低资源部署。
对位
对位 Ternary-Bonsai-8B(同类三元量化)
适合
低资源 CPU 聊天推理 / 结构化 JSON 输出/工具调用
不适合
数学推理
规模
8B · 40k · Q4 ~5.3GB / FP16 ~19GB
授权
Apache-2.0 · 需自查
框架
transformers / llama.cpp / mlx
血统
量化自 Qwen3-8B
可信度
下载 5k+,Apache-2.0,提供可重现的 IFEval/GSM8K 基准分数

快速上手示例

ollama run hf.co/FermionResearch/Neutrino-8B

依赖版本和硬件参数请以源仓库说明为准。

评分详情

Q1
今天能接上用吗   5 / 5
Q2
有可信证据吗   1 / 5
Q3
是新东西吗   1 / 5
总分
7

HuggingFace 原始数据 (抓取于 2026-08-02)

作者
FermionResearch
任务类型
text-generation
推理库
transformers
下载
5,060
点赞
62
许可证
Apache-2.0
标签
transformers, gguf, trtc_v4, text-generation, ternary, sub-2-bit, quantization, trtc, conversational, base_model:Qwen/Qwen3-8B, base_model:quantized:Qwen/Qwen3-8B, license:apache-2.0, endpoints_compatible, region:us

探索

源链接