此页是 2026-08-29 的观测快照,查看该模型当前信息 → /m/lmstudio-community__qwen38-flash-next-gguf/

归档 / 2026-08-29 / Qwen3.8-Flash-Next (Qwen)

Qwen3.8-Flash-Next (Qwen)

Qwen3.8 Flash 的 GGUF 量化,面向本地推理

入选理由
Qwen3.8-Flash-Next 官方模型的 GGUF 量化版,可直接在 LM Studio 等本地工具加载运行;适合需要本地部署、快速体验最新 Qwen 对话能力的开发者。
对位
对位 Qwen3-4B / Llama-3.2-3B
适合
GGUF 量化本地推理 / 低显存/边缘设备部署
不适合
需要原始权重微调或高精度推理
规模
3.8B · 未知 · Q4 ~2.5GB / FP16 ~9.1GB
授权
other · 需自查
框架
llama.cpp / ollama / lmstudio
血统
量化自 Qwen3.8-Flash-Next
可信度
HF 下载量 1047;GGUF 由 LM Studio 用 llama.cpp b10662 转制

快速上手示例

llama-server -hf lmstudio-community/Qwen3.8-Flash-Next-GGUF

依赖版本和硬件参数请以源仓库说明为准。

评分详情

Q1
今天能接上用吗   5 / 5
Q2
有可信证据吗   3 / 5
Q3
是新东西吗   1 / 5
总分
9

HuggingFace 原始数据 (抓取于 2026-08-29)

作者
lmstudio-community
任务类型
unknown
推理库
未指定
下载
1,047
点赞
0
许可证
other
标签
gguf, base_model:Qwen/Qwen3.8-Flash-Next, base_model:quantized:Qwen/Qwen3.8-Flash-Next, license:other, endpoints_compatible, region:us, conversational

探索

源链接