模型 / Qwen3.8-Flash-Next Optimized Speed (MTPLX)

Qwen3.8-Flash-Next Optimized Speed (MTPLX)

Mac 上 MTPLX 4-bit 量化,MTP 投机加速

作者 Youssofal

仓库标识Youssofal/Qwen3.8-Flash-Next-MTPLX-Optimized-Speed

~75GB 4-bit许可 需自查任务 文本生成最近核对 2026-08-31
格式
4-bit
文件
~65GB
运行内存
~75GB–98GB
运行时
MTPLX
下载
2,374

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

快速上手示例

mtplx serve --model Youssofal/Qwen3.8-Flash-Next-MTPLX-Optimized-Speed

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
基于 Qwen 官方新模型的 MLX 量化版,主打 Apple Silicon 上 2-3 倍加速,利用 MTP 投机采样。适合拥有 96GB+ 内存 Mac 的本地推理用户。
对位
对位 Mixtral-8x7B / Qwen3-30B-A3B
适合
苹果芯片 Mac 本地聊天 / 长上下文与代码生成
不适合
96GB 以下 Mac 或高精度需求

完整规格

规模
125B-A6B · 262k · 下载 ~65GB · 显存最低 ~75GB · 推荐 ~98GB · 4-bit(估算)
授权
qwen-community-1.0 · 需自查
框架
mlx / mtplx
血统
量化自 Qwen3.8-Flash-Next
访问提示
Hugging Face 可能需要代理

下载动量

观测时间线

模型家族

查看全部家族 →