此页是 2026-07-21 的观测快照,查看该模型当前信息 → /m/majentik__gpt-oss-20b-turboquant-mlx-2bit/

归档 / 2026-07-21 / GPT-OSS-20B (OpenAI)

GPT-OSS-20B (OpenAI)

2-bit 量化 MLX 模型,专为 Apple Silicon 推理

  • Apple Silicon
  • 已量化
入选理由
苹果M芯片用户可用mlx-lm快速跑2bit量化版GPT-OSS-20B,约6GB显存,质量有损但适合低内存设备。无第三方验证,仅量化重打包。
对位
适合
Apple Silicon 设备本地推理 / 极低内存占用(约 6 GB)
不适合
高精度文本生成
规模
20B (MoE) · 未知 · Q4 ~14GB / FP16 ~50GB
授权
Apache 2.0 · 需自查
框架
mlx
血统
量化自 gpt-oss-20b
可信度
OpenAI 开源 MoE 20B 的 2-bit MLX 量化版,hf 下载数 283

仅 safetensors · 无 pickle 加载风险

快速上手

mlx_lm.generate --model majentik/gpt-oss-20b-TurboQuant-MLX-2bit --prompt '你的提示'

评分详情

Q1
今天能接上用吗   5 / 5
Q2
有可信证据吗   1 / 5
Q3
是新东西吗   1 / 5
总分
7

HuggingFace 原始数据 (抓取于 2026-07-21)

作者
majentik
任务类型
text-generation
推理库
mlx
下载
283
点赞
0
许可证
Apache 2.0
标签
mlx, safetensors, gpt_oss, turboquant, kv-cache-quantization, gpt-oss, openai, moe, quantized, 2bit, text-generation, conversational, arxiv:2504.19874, base_model:openai/gpt-oss-20b, base_model:quantized:openai/gpt-oss-20b, license:apache-2.0, 4-bit, region:us

探索

源链接