流式自回归 TTS,面向实时对话与语音代理
适合实时语音代理 / 流式对话与配音
短板精确声纹匹配任务
Q4 ~0.4GB / FP16 ~1.3GB · Apache 2.0 (codec: NVIDIA Open Model License) · 未知 · vllm需自查
证据1468 下载 / 62 赞
流式自回归 TTS,面向实时对话与语音代理
适合实时语音代理 / 流式对话与配音
短板精确声纹匹配任务
Q4 ~0.4GB / FP16 ~1.3GB · Apache 2.0 (codec: NVIDIA Open Model License) · 未知 · vllm需自查
证据1468 下载 / 62 赞
视觉语言模型,思考令牌减半,GGUF量化,适合本地运行
适合需要思维链但希望节省Token成本 / 本地视觉问答与推理部署
短板长链深度推理,精度可能略降
Q4 ~18GB / FP16 ~65GB · unknown · 未知 · llama.cpp需自查
证据298.8k 下载 / 57 赞
1B 思维链模型 GGUF 量化,本地轻量代码与指令任务
适合代码生成与调试 / 基于思维链的长上下文指令跟随
短板不适合高精度世界知识任务
Q4 ~0.7GB / FP16 ~2.4GB · apache-2.0 · 128k · llama.cpp需自查
证据2239 下载 / 140 赞 / 3 个社区来源
Claude Opus推理蒸馏并反审查的27B模型GGUF版
适合复杂推理与多步逻辑 / 创意写作与无过滤对话
短板安全合规的生产环境
Q4 ~18GB / FP16 ~65GB · apache-2.0 · 256K · llama.cpp需自查
证据132 下载
输入关键词,跨模型 / 数据集 / 空间 / 工具 / 资讯 / 论文 检索