模型 / Qwen3.8-Flash-Next-Uncensored (orcarouter)

Qwen3.8-Flash-Next-Uncensored (orcarouter)

Qwen3.8 GGUF,本地图像文本推理

作者 orcarouter

仓库标识orcarouter/Qwen3.8-Flash-Next-Uncensored-GGUF

~2.3GB 4-bit许可 需自查任务 智能体最近核对 2026-08-29
格式
4-bit
文件
~2GB
运行内存
~2.3GB–3GB
运行时
LLAMA-SERVER
下载
20,275

Hugging Face 源仓库 ↗

快速上手示例

llama-server -hf orcarouter/Qwen3.8-Flash-Next-Uncensored-GGUF

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
可直接用 llama.cpp 运行的 Qwen3.8-Flash-Next 去审查量化版,支持视觉输入和函数调用,适合本地部署。
对位
对位 Qwen2.5-VL-3B 等 3B 级多模态
适合
本地图像文本对话 / 低资源设备的 GGUF 推理
不适合
高风险合规或商用授权场景

完整规格

规模
3.8B · 下载 ~2GB · 显存最低 ~2.3GB · 推荐 ~3GB · 4-bit(估算)
商用
需自查
框架
llama.cpp
血统
量化自 Qwen3.8-Flash-Next
访问提示
Hugging Face 可能需要代理

下载动量

观测时间线

模型家族

查看全部家族 →