模型 / Qwen3.8-Flash-Next (Qwen)

Qwen3.8-Flash-Next (Qwen)

Qwen3.8 Flash 的 GGUF 量化,面向本地推理

作者 lmstudio-community

仓库标识lmstudio-community/Qwen3.8-Flash-Next-GGUF

~2.3GB 4-bit许可 需自查最近核对 2026-08-29
格式
4-bit
文件
~2GB
运行内存
~2.3GB–3GB
运行时
LLAMA-SERVER
下载
1,047

Hugging Face 源仓库 ↗

快速上手示例

llama-server -hf lmstudio-community/Qwen3.8-Flash-Next-GGUF

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
Qwen3.8-Flash-Next 官方模型的 GGUF 量化版,可直接在 LM Studio 等本地工具加载运行;适合需要本地部署、快速体验最新 Qwen 对话能力的开发者。
对位
对位 Qwen3-4B / Llama-3.2-3B
适合
GGUF 量化本地推理 / 低显存/边缘设备部署
不适合
需要原始权重微调或高精度推理

完整规格

规模
3.8B · 下载 ~2GB · 显存最低 ~2.3GB · 推荐 ~3GB · 4-bit(估算)
授权
other · 需自查
框架
llama.cpp / ollama / lmstudio
血统
量化自 Qwen3.8-Flash-Next
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 0 → 7k

观测时间线

模型家族

查看全部家族 →