模型 / 归档 / 2026-08-06

本期 (9)

未公开

多语言嵌入,支持稠密/稀疏/多向量检索,8k上下文

适合多语言跨语种语义检索 / RAG混合检索与重排序

短板单语言专项微调需求

未公开 · MIT · 8192 · FlagEmbedding需自查

证据34991.9k 下载 / 3366 赞

7B

Qwen2.5 7B 指令模型,用于多语言对话与长文本生成。

适合多语言聊天与长文档处理 / 结构化 JSON 输出与代码生成

短板非严格事实核查或实时数据场景

Q4 ~5GB / FP16 ~18GB · Apache-2.0 · 128k · transformers需自查

证据12117.9k 下载 / 1527 赞

1.55B

多语言语音识别与翻译,零样本泛化

适合多语言语音转录 / 语音翻译为英文

短板低延迟实时转录

Q4 ~1GB / FP16 ~3.7GB · Apache 2.0 · 30s 音频 · transformers需自查

证据5497.4k 下载 / 6100 赞

8B

8B 指令微调模型,用于通用对话与文本生成任务

适合通用聊天与指令跟随 / 内容生成、摘要与翻译

短板需要严格事实核查的场景

Q4 ~5.3GB / FP16 ~19GB · Llama 3.1 Community License · 128k · transformers需自查

证据8014.8k 下载 / 6536 赞

2.6B

端侧部署的混合架构模型,用于文本生成。

适合端侧轻量文本对话与生成 / 多语言基础问答

短板高精度推理与复杂数学

Q4 ~1.7GB / FP16 ~6.2GB · lfm1.0 · 未知 · llama.cpp需自查

证据185 下载 / 93 赞

27B

带 MTP 自推测解码的 GGUF 量化版,加速本地推理

适合代码生成 (HumanEval 83.5%) / 长文本 CoT 推理加速 (2x)

短板视觉多模态任务 (MTP 未验证)

Q4 ~18GB / FP16 ~65GB · apache-2.0 · 128k · llama.cpp需自查

证据4608 下载 / 9 赞

35B (3B激活)

35B MoE多模态GGUF,无审查角色扮演与函数调用代理

适合无审查角色扮演 / 函数调用代理

短板复杂代码生成

Q4 ~23GB / FP16 ~84GB · apache-2.0 · 262K (可扩至1M) · llama.cpp需自查

证据308.9k 下载 / 384 赞

未公开

未审查 DeepSeek-V4-Flash GGUF,供研究测试

  • 已量化

适合安全对齐与机制研究 / 无审查内容生成实验

短板生产或面向公众使用

未公开 · MIT · 256k · llama.cpp需自查

证据14k 下载 / 84 赞

未公开

Krea 2 的 LoRA 适配器,ComfyUI 直接加载

适合Krea 2 风格化生成 / ComfyUI 工作流集成

短板仅限 Krea 2 基座模型使用

未公开 · MIT · 未知 · ComfyUI需自查

证据190 赞

← 前一日 2026-08-05 · 后一日 2026-08-07 →