修复循环的Qwen3.5推理模型GGUF,支持1M上下文与视觉
适合长文档推理与多模态问答 / 本地私有部署的思维链推理
短板极高精度视觉任务(视觉塔未微调)
Q4 ~5.9GB / FP16 ~22GB · Apache-2.0 · 1M · llama.cpp需自查
证据15.5k 下载 / 71 赞
修复循环的Qwen3.5推理模型GGUF,支持1M上下文与视觉
适合长文档推理与多模态问答 / 本地私有部署的思维链推理
短板极高精度视觉任务(视觉塔未微调)
Q4 ~5.9GB / FP16 ~22GB · Apache-2.0 · 1M · llama.cpp需自查
证据15.5k 下载 / 71 赞
Apple Silicon 本地 4-bit 混合精度量化文本生成模型
适合本地代码/推理/工具调用任务 / Apple Silicon 上的高精度轻量部署
短板需 NVIDIA GPU 的部署场景
Q4 ~5.9GB / FP16 ~21GB · apache-2.0 · 128k · mlx需自查
证据12k 下载 / 78 赞
修复循环生成并保留1M上下文推理能力的研究型模型
适合长文本推理与代码生成 / 未过滤的研究与安全测试
短板需要高吞吐编码辅助的场景
Q4 ~6.4GB / FP16 ~23GB · Apache-2.0 · 1048k · vllm需自查
证据993 下载 / 71 赞
Krea-2 Turbo 风格化 LoRA,电影感氛围增强
适合艺术风格增强 / 电影感氛围生成
短板精确物体形状控制
未公开 · apache-2.0 · 未知 · diffusers需自查
证据1577 下载 / 73 赞
Apple Silicon 上 Claude-Code 式本地编码代理
适合苹果芯片本地编码代理 / 低资源Mac代码生成/对话
短板16/18 GB 内存 Mac 不可用
Q4 ~23GB / FP16 ~83GB · unknown · 未知 · mlx需自查
证据818 下载
输入关键词,跨模型 / 数据集 / 空间 / 工具 / 资讯 / 论文 检索