模型 / GPT-OSS-20B (OpenAI)

GPT-OSS-20B (OpenAI)

2-bit 量化 MLX 模型,专为 Apple Silicon 推理

作者
majentik
适合
Apple Silicon 设备本地推理 / 极低内存占用(约 6 GB)
不适合
高精度文本生成
入选理由
苹果M芯片用户可用mlx-lm快速跑2bit量化版GPT-OSS-20B,约6GB显存,质量有损但适合低内存设备。无第三方验证,仅量化重打包。
规模
20B (MoE) · Q4 ~14GB / FP16 ~50GB
授权
Apache 2.0 · 需自查
框架
mlx
血统
量化自 gpt-oss-20b
国内访问
需代理
可信度
OpenAI 开源 MoE 20B 的 2-bit MLX 量化版,hf 下载数 283

本形态显存 Q4 ~14GB / FP16 ~50GB · 国内 需代理 · 283 下载

仅 safetensors · 无 pickle 加载风险

快速上手

mlx_lm.generate --model majentik/gpt-oss-20b-TurboQuant-MLX-2bit --prompt '你的提示'

本形态源 ↗

观测时间线

模型家族

查看全部家族 →