模型 / Qwen3.8-27B-VQ-4.8bpw (Qwen)

Qwen3.8-27B-VQ-4.8bpw (Qwen)

Apple Silicon 本地运行的 27B 向量量化文本生成模型

作者 TheDrainFlorist

仓库标识TheDrainFlorist/Qwen3.8-27B-VQ-4.8bpw

显存未知许可 可商用任务 文本生成最近核对 2026-09-06
运行内存
格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
运行时
PYTHON
下载
1,214

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

快速上手示例

python -m mlx_lm generate --model TheDrainFlorist/Qwen3.8-27B-VQ-4.8bpw --prompt "Explain vector quantization briefly." --max-tokens 512

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
Qwen3.8-27B 的 MLX 向量量化版,15.5GB 可在 Apple Silicon 上以 mlx-lm 直接运行,解码约 25 tok/s,适合本地部署。
对位
对位 Gemma 2 27B 同规模开源模型
适合
Apple Silicon 本地推理 / 量化损失对比研究
不适合
非 Apple Silicon 平台或高精度应用

完整规格

规模
27B · 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
授权
Apache-2.0 · 可商用
框架
mlx-lm
血统
量化自 Qwen3.8-27B
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 1.7k → 2.3k

观测时间线

模型家族

查看全部家族 →