模型 / Hy4-preview-GGUF (Tencent)

Hy4-preview-GGUF (Tencent)

腾讯 Hy4 量化版,需补丁构建 llama.cpp

作者 AngelSlim

仓库标识AngelSlim/Hy4-preview-GGUF

显存未知许可 需自查最近核对 2026-09-05
运行内存
缺少可用的参数量依据,无法估算显存
运行时
llama.cpp
下载
109,240

Hugging Face 源仓库 ↗

适合与不适合

入选理由
腾讯 Hy4-preview 的 GGUF 量化包,提供 Q4_K_M 和半精度 STQ1_0 方案,MoE+MLA 架构,需自行打补丁编译 llama.cpp,适合具备多卡高显存环境的玩家。
对位
对位 DeepSeek-V3(671B 级 MoE)
适合
8xH20 以上集群批处理推理 / 验证 2.38bpw 混合量化策略
不适合
单卡或未打补丁 llama.cpp

完整规格

规模
缺少可用的参数量依据,无法估算显存
商用
需自查
框架
llama.cpp
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 171.4k → 323.7k

观测时间线