Access · 需代理

共 429 个 (跨 111 天)

2026-09-17

Ornith-1.5-9B (junafinity) 9B 多模态 GGUF 量化,视觉+文本,给本地量化部署者

2026-09-15

Qwen3.8-27B-TWIN-TURBO (DavidAU) 27B图像文本微调GGUF,面向本地硬件推理 Logicer-GGUF (batuhan-elibuyuk) Logicer 模型 GGUF 量化文件,面向本地推理用户 Swift-Qwen3.8-27B-GGUF (UkisAI) Qwen3.8-27B 低思考 token GGUF,支持图像输入

2026-09-14

LTX-2.5-uncensored-v1.1-FP8 (ChrisColeTech) LTX-2.5 FP8视频模型,合并多个LoRA,支持文/图生视频 Qwen3.8-27B TWIN-TURBO GGUF (DavidAU) Qwen3.8-27B 多阶段微调 GGUF,面向本地创意与开发。 Qwen3-4B-Base-DAPO-v4 (ReliquaryForge) Qwen3-4B-Base-DAPO-v4 文本生成模型

2026-09-13

Qwen3.5-9B-Atlassian-Q4-mlx (LeanZero) Forge/Jira 开发辅助 4-bit MLX Qwen3.5-9B-Atlassian-Q6-mlx (LeanZero) 面向 Atlassian Forge 的 6-bit MLX 模型 Qwen3.8-27B-Atlassian-Q4-mlx (LeanZero) 面向 Atlassian Forge 的 4-bit MLX 模型 Qwen3.8-27B-Atlassian-Q8-mlx (LeanZero) Atlassian 开发专用 27B MLX 模型 OUI-1 (Thesys) 生成式 UI 扩散模型,面向 OpenUI 应用开发者

2026-09-12

Edge0-35B-A3B-preview (Edge0) 35B 稀疏 MoE,3 GiB 内存可跑,面向设备端推理 Kimi-K3-UD-Q4_K_XL-layers (meshllm) Q4_K_XL 量化分层权重,供本地调试

2026-09-11

mt-support-3g-v2 (dasLOL) 任务与用途未知,无模型卡说明

2026-09-10

Qwen3.6-35B-A3B-VQ-3.4bpw (TheDrainFlorist) Apple 芯片 13.8GiB VQ 量化,24GB 可跑

2026-09-08

Spark-X2.5-4B-GGUF (XHToken) 4B 通用文本模型 GGUF,可本地跑对话、编码与 agent

2026-09-07

Qwen3.6-35B-A3B-VQ-3.8bpw (TheDrainFlorist) Apple Silicon VQ量化 Qwen3.6-35B-A3B Qwen3.6-35B-A3B-VQ-4.6bpw (TheDrainFlorist) Mac 可跑的 Qwen3.6-35B VQ 量化 Qwen3.6-35B-A3B-VQ-5.4bpw (TheDrainFlorist) MLX 向量量化,Apple Silicon 本地推理 VibeVoice-ASR-Streaming-7B (Microsoft) 流式说话人归属语音转写,支持10语言与热词 DeepSeek-V4-Flash-Vision-Exp-GGUF (Unsloth) DeepSeek-V4 视觉实验 GGUF,本地跑多模态 agent

2026-09-06

K2-Horizon-7B (IFM) 7B 密集解码器,512K 上下文,面向推理/代码/长上下文 K2-Horizon-MoVA-36B-A4B (IFM) 36B/4B 激活 MoE+MoVA,面向 agent 与长上下文 Qwen3.8-27B-VQ (TheDrainFlorist) Apple Silicon 用 Qwen3.8-27B 量化版 Qwen3.8-27B-VQ-4.5bpw (Qwen) Qwen3.8-27B MLX 向量量化版 Qwen3.8-27B-VQ-4.8bpw (Qwen) Apple Silicon 本地运行的 27B 向量量化文本生成模型

2026-09-05

Hy4-preview-GGUF (Tencent) 腾讯 Hy4 量化版,需补丁构建 llama.cpp Qwopus3.8-27B-Flash-GGUF (Jackrong) Qwen3.8-27B 微调 GGUF,面向本地 agent 工作流 Spark-X2.5-1.7B (XHToken) 1.7B 通用语言模型,支持 1M 上下文与工具调用 speaker-diarization-community-1 (pyannote) 社区版说话人分离,用于会议/访谈音频

2026-09-04

Qwen3.8-27B-TURBO-Fable-Cold-Fusion (DavidAU) 图像文本多模态 GGUF,面向本地消费级硬件部署 K2-Horizon-MoVA-36B-A4B (IFM) 36B MoE 开源模型,4B 激活,面向 agent/推理 Qwen3.8-27B (ISTA-DASLab) GSQ-RCO 非均匀 GGUF 量化,含视觉投影器 VDN-Minimax-H3 (OpenVDN) 混合注意力视频生成:14.4s片段11.23s Spark-X2.5-4B (XHToken) 4B 通用语言模型,面向对话/代码/agent Qwen3.8-27B (Qwen) Mac本地Qwen3.8-27B-4bit量化 Qwen3.8-27B MTPLX (Youssofal) Mac 上 8-bit 量化 Qwen3.8 27B(MTP 加速) Granite-4.2-3B-MLX-6bit (IBM) Granite 4.2 3B MLX 6bit 量化,本地推理 GPT-2 (OpenAI) 英文因果语言模型,用于文本生成与下游微调 all-MiniLM-L6-v2 (sentence-transformers) 英文句子/短段落向量化,用于语义搜索与聚类 GLM-5.3-GGUF (unsloth) 开源 MoE 代码与智能体模型 GGUF 量化版

2026-08-31

Qwen3.8-Flash-Next Optimized Speed (MTPLX) Mac 上 MTPLX 4-bit 量化,MTP 投机加速

2026-08-30

Granite-4.2-8B-MLX-6bit (LM Studio) Granite 4.2 8B 的 MLX 6-bit 量化

2026-08-29

FastVideo-FastH3-4-step-Preview-v1-VSA-DataFree (FastVideo) 文本生成同步音视频,4步推理 SemanticRepair-270M (Gramscii) 面向 RAG 路由的查询重写小模型 GLM-5.3-Flash-DFlash2 (incoai) 为 GLM-5.3-Flash 推理加速的 DFlash2 草稿模型 Qwen3.8-Flash-Next (Qwen) Qwen3.8 Flash 的 GGUF 量化,面向本地推理 Granite-4.2-30B-MLX-6bit (LM Studio) IBM 30B MLX 6bit 量化,Mac 用 Granite-4.2-3B-MLX-4bit (LM Studio) 3B开源文本生成模型,面向Apple Silicon本地推理与工具调用 Granite-4.2-3B-MLX-8bit (LM Studio) IBM Granite 3B MLX 量化,苹果芯片推理 Qwen3.8-Flash-Next-Uncensored (orcarouter) Qwen3.8 GGUF,本地图像文本推理 PhoneLLM Alpha 1 (Pipecat) 面向电话语音代理的 30B-A3B 微调模型

2026-08-28

Qwen3.8-27B-MTPLX-Optimized-Speed (Youssofal) Mac 上 Qwen3.8-27B 4-bit量化 Apodex-1.1-mini (Apodex) 面向复杂研究任务的推理型 agent 模型 Granite-4.2-30B (IBM) IBM 30B 推理模型,原生 thinking 与工具调用 MiniMax-H3-x-Z-Image-native (MiniMaxAI) H3×Z-Image 嫁接,ComfyUI 文生视频 Granite-4.2-30B-MLX-4bit (LM Studio) Granite 4.2 30B MLX 量化,Mac Granite-4.2-30B-MLX-8bit (IBM/LM Studio) Granite 30B MLX 8-bit,本地推理 Granite-4.2-8B-MLX-4bit (LM Studio) Granite 8B MLX 4bit,Mac推理 Tiel-Coder-35B-A3B-GGUF (peculiar-ragdoll) 35B-A3B 编程模型,本地 Agent 编码 WeMM-Embedding-9B (Tencent) 腾讯多模态嵌入模型,支持文本/图像/视频编码,输出 4096 维向量

2026-08-27

Breeze-TTS-2 (BreezeBlue) 中英文实时TTS,支持语音克隆/设计/定向 MiniMax-H3-Acc-LoRAs (阿里 PAI) MiniMax-H3 8步加速 LoRA,面向视频生成 Granite-4.2-30B (IBM) IBM Granite 4.2 30B GGUF 量化版,本地推理 Granite-4.2-3B GGUF (IBM) IBM 3B GGUF 量化,本地推理 Granite-4.2-8B (IBM) Granite 8B GGUF 量化版,本地推理 Granite-4.2-8B-MLX-8bit (IBM) Granite 4.2 8B MLX 量化版,Mac 本地跑 Qwen3.8-Whittle-MoE-27B-A17.8B (logic65) 从 Qwen3.8-27B 切割的 MoE,24GB 本地对话/代码

2026-08-26

MiniMax-H3-RAVEN-Streaming-LoRA (mvp-lab) MiniMax-H3 流式视频生成 LoRA

2026-08-25

MiniMax-H3-Fun-Controlnet-Union (阿里 PAI) MiniMax-H3 视频控制分支,支持 5 种控制条件与视频修复 Dirk-Qwen3.8-27B (peculiar-ragdoll) 27B GGUF 量化,Sharp 模板+MTP,视觉

2026-08-24

Audio8-TTS-0.1B (Audio8) 0.17B 零样本语音克隆,中英为主多语种 TTS Qwen3.8-27B-Escha-W2 (Escha) 2-bit 量化 27B 模型,24GB 显卡 64k 上下文 H3 Character Sheet Generator (PoopMan333) ComfyUI 角色表生成,多参考图 360° 一致角色 Qwen3.8-27B-Unleashed (outsourc-e) 无审查 Qwen3.8-27B 动态量化 GGUF,本地推理 Qwen3.8-27B-DFlash2-GGUF (z-lab) Qwen3.8-27B 的投机解码草案模型,需搭配目标模型使用 Qwen3.8-27B-DFlash2 (z-lab) 为 Qwen3.8-27B 提供投机解码加速的草案模型

2026-08-22

Qwen3.8-27B-DFlash2-GGUF (incoai) llama.cpp 投机解码草稿模型 GGUF Ornith-1.5-35B-A3B (Ornith) 35B MoE 激活 3B,面向工具调用与长上下文推理 S1-mini (Superwhisper) ASR 后处理文本规范化器,英文听写与字幕管道用

2026-08-21

LFM2.5-8B-A1B-DSpark-GGUF (LiquidAI) 8B-A1B 投机解码草稿侧车,配 llama.cpp 加速 Qwen3.8-27B-OBLITERATED (OBLITERATUS) 无审查 Qwen3.8-27B,供红队与对齐研究 Ornith-1.5-35B-A3B-GGUF (Ornith) 35B MoE 激活3B GGUF,本地编码与工具调用 Ornith-1.5-9B-GGUF (ornith-ai) 9B 推理模型 GGUF,供本地编码与代理使用 Ornith-1.5-9B (ornith-ai) 9B 稠密推理模型,单卡部署与终端编程 Dagger-Qwen3.6-27B (peculiar-ragdoll) Mac 用 Qwen3.6-27B MLX 量化,低冗余输出

2026-08-20

Qwen3.8-27B Heretic Abliterated GGUF (0bserverx) Qwen3.8-27B 去安全限制 GGUF,供角色扮演与创作 Qwen3.8-27B-Cold-Fusion-GAIN-V1.1 (DavidAU) Qwen3.8-27B 微调 GGUF,减思考 token 支持视觉 Qwen3.8-27B-Uncensored-HauhauCS-Aggressive-MTP-GGUF (HauhauCS) 27B 未审查 GGUF,带视觉与 FastMTP Qwen3.8-9B-Distill-GGUF (Empero) 9B 蒸馏推理模型 GGUF 量化,本地部署用 Qwen3.8-9B-Distill (Empero) 全参蒸馏 9B 推理模型,面向数学/代码/工具调用 Huihui-Qwen3.8-27B-abliterated-GGUF (huihui-ai) 去拒绝版 Qwen3.8-27B GGUF,多模态本地推理 Qwen3.8-27B-DFlash2 (incoai) Qwen3.8 草稿模型,用于 SGLang/vLLM 投机解码 Qwen3.8-27B-Uncensored-GGUF (orcarouter) 27B 图像-文本到文本 GGUF,本地推理

2026-08-18

Qwen3.8-27B-GGUF (AtomicChat) Qwen3.8-27B 量化版,本地图文对话与转写 hamo-score-0.6b (HamoAI) 给心理支持对话逐句打五维评分,供本地部署 Qwen3.8-9B (Empero) 9B 蒸馏推理模型,面向数学/代码/工具调用

2026-08-17

Qwen3.8-27B-ABLITERATED (Blackfrost) GGUF 量化 27B 图文模型,供 llama.cpp 本地部署 Amethyst-1-Mini (VertexAIco) Gemma 3 4B 蒸馏微调对话模型,面向轻量试验与聊天 Qwen3.8-27B-Ridge-GGUF (empero-ai) Qwen3.8-27B 混合量化 GGUF,本地图文推理

2026-08-16

Qwen3.6-27B-Uncensored-Aggressive (HauhauCS) Qwen3.6-27B 无审查多模态 GGUF,本地部署 Qwen3.8-27B-Uncensored-GGUF (JonathanColetti) 27B 未审查 GGUF,含 MTP 投机解码 Qwen3.8-27B (LM Studio) Qwen3.8-27B 的 GGUF 量化,本地部署推理

2026-08-15

LFM2.5-2.6B-MLX-5bit (LM Studio) 2.6B 5-bit MLX 量化,Mac 本地推理 Qwen3.8-27B-GGUF (Unsloth) Qwen3.8-27B GGUF,本地推理与多模态

2026-08-14

MiniMax-H3 (DeepBeepMeep) MiniMax H3 图像模型集,WanGP 可用 Wan_GGUF (MonsterMMORPG) Wan 视频模型 GGUF 量化仓库,本地推理用 Muse-Glimmer-30B (meta-models) 30B GGUF 量化模型,供 LM Studio 本地推理 NVIDIA-Nemotron-3.5-Lightning-30B-A3B (NVIDIA) 30B 总参 / 3B 激活 MoE,本地 GGUF 部署

2026-08-13

Needle2-45M (Cactus Compute) 45M 工具调用模型,14MB 二进制跑边缘设备 Anima-2.9B (Gazingstars) 动漫/插画文本生图模型,面向二次元创作者 ClipProj-MiniMax-H3 (NicoLab28) ComfyUI 用 Qwen3-VL 4B/8B 替代 H3 编码器

2026-08-12

MiniMax H3 Realism People LoRA (fal) MiniMax-H3 真人写实 LoRA,专攻人像与日常场景视频生成 Nemotron-3.5-Lightning-30B-A3B (NVIDIA) 30B总参3B激活,为微调与量化而设计 Nemotron-3.5-Lightning-30B-A3B (NVIDIA) 3B活跃参数,面向本地Agent和长上下文推理

2026-08-11

LFM2.5-2.6B (LiquidAI) 6-bit MLX 量化推理模型,为 Apple Silicon 优化 Muse-Glimmer-30B (Meta Superintelligence Lab) 30B 本地智能体多模态模型,GGUF 量化,文本+图像推理 MiniMax-H3-GGUF (unsloth) 图/文生成视频+音频,本地运行 GGUF 量化 Muse-Glimmer-30B-GGUF (Unsloth) 30B 多模态代理模型, 本地化量化推理

2026-08-10

GLM-5.2 (智谱) 1M 上下文旗舰模型,适合复杂长程任务开发 Nanbeige4.2-3B (Nanbeige) 3B Agent 模型 GGUF 量化版本,用于资源受限部署

2026-08-09

Qwen3.6-35B-A3B (AutomatosX) Apple Silicon 本地推理的 MLX 6-bit 量化模型 LFM2.5-2.6B (LiquidAI) LFM2.5-2.6B GGUF 量化,本地部署通用文本生成 LFM2.5-2.6B-MLX-4bit (LiquidAI) Apple Silicon 用 4-bit 量化 LFM,始终思考模式

2026-08-08

MiniMax-H3-GGUF (MiniMax) 音视频同步生成多模态模型 GGUF 量化包 fuse-1-Lite (Akahsizrr) 5.7B MoE,融合LFM2与Qwen编码专家,用于代码生成 CharacterSheet (Alissonerdx) 将角色图片转为三视图、四视图及动态角色设定表的 LoRA 集合 BTL-4 (Bad Theory Labs) 面向工具调用与软件工程的35B推理模型 Maple-Preview (DeepGrove) 20B-A1B 三元推理模型,M4 218 tok/s LFM2.5-2.6B-MLX-8bit (LM Studio) 8-bit MLX量化一直思考模型,Apple Silicon用 Ornith-1.0-9B-MLX (deepreinforce-ai) 通用文本生成的MLX量化版,供Apple Silicon本地使用

2026-08-07

MiniMax-H3 Turbo LoRA (drbaph) MiniMax-H3 4步加速LoRA,ComfyUI 专用 MiniMax-H3 Turbo LoRA (larryvrh) 4步生成同步音视频的 MiniMax-H3 加速 LoRA MiniMax-H3 (MiniMax) MiniMax H3 视频模型 GGUF 版,ComfyUI 用

2026-08-06

BGE-M3 (BAAI) 多语言嵌入,支持稠密/稀疏/多向量检索,8k上下文 LFM2.5-2.6B (LiquidAI) 端侧部署的混合架构模型,用于文本生成。 Qwen3.6-35B-A3B (Qwen) 35B MoE多模态GGUF,无审查角色扮演与函数调用代理 Qwen3.6-27B Omnimerge v4 MTP (ManniX-ITA) 带 MTP 自推测解码的 GGUF 量化版,加速本地推理 Qwen2.5-7B-Instruct (Qwen) Qwen2.5 7B 指令模型,用于多语言对话与长文本生成。 DeepSeek-V4-Flash-Ablit (huihui-ai) 未审查 DeepSeek-V4-Flash GGUF,供研究测试 Kroma (lodestones) Krea 2 的 LoRA 适配器,ComfyUI 直接加载 Llama-3.1-8B-Instruct (Meta) 8B 指令微调模型,用于通用对话与文本生成任务 Whisper-large-v3 (OpenAI) 多语言语音识别与翻译,零样本泛化

2026-08-05

LFM2.5-2.6B (LiquidAI) 2.6B 混合架构代理模型,面向端侧工具调用与 128K 长上下文任务

2026-08-04

DeepSeek-V4-Flash GGUF (DeepSeek) ds4引擎 DeepSeek-V4-Flash 量化,Mac 本地运行 Ornith-1.0-35B (deepreinforce-ai) MLX 6-bit 35B,用于 Apple Silicon 文本生成 Ornith-1.0-9B-MLX-6bit (deepreinforce-ai) MLX量化9B文本模型,苹果芯片本地推理 Koleslaw-Nemotron-30B (ThunkAboutIt) 把粗糙提示变成结构化详细提示,方便交给任意模型

2026-08-03

Fish Audio S2 Pro (Fish Audio) 多语种TTS,细粒度韵律/情感内联控制,80+语言 Ornith-1.0-35B-MLX-4bit (lmstudio-community) 在 Apple Silicon 上运行的 35B 文本生成模型 Ornith-1.0-35B-MLX (LM Studio) 苹果硅本地运行的 35B 文本生成模型 Ornith-1.0-9B-MLX (LM Studio) MLX 8-bit量化,为Apple Silicon优化 LongCat-Flash-Lite-Sparse (美团) 69B MoE,仅3B激活,1M上下文,面向Agent与长文本任务

2026-08-02

Neutrino-8B (Fermion) 子 2 比特 8B 聊天模型,容器 2.56 GB Kimi-K3-0.40B (moonshotai) 轻量级Kimi-K3测试版,保留混合注意力MoE,用于特征提取开发 DeepSeek-V4-Flash-0731 (DeepSeek) DeepSeek V4 系列轻量模型,本地快速对话 Ornith-1.0-35B MLX (lmstudio-community) Apple Silicon本地35B生成模型MLX量化版 Inkling-Small-GGUF (Unsloth) 多模态文本/图像/音频输入,GGUF 量化,适合本地运行。 Ornith-1.0-9B (DeepReinforce) MLX 4-bit量化,Apple Silicon文本生成

2026-08-01

Bonsai-27B (Prism) 多模态 27B 模型,纯 Q1_0 量化,语言部分仅 3.8 GB Ornith-1.0-35B (deepreinforce-ai) 35B开源语言模型,GGUF格式便于本地部署 Ornith-1.0-9B (deepreinforce-ai) LM Studio 提供的 GGUF 量化版,适用本地部署 DeepSeek-V4-Flash-0731 (DeepSeek) 深度求索闪速版,强化智能体与代码场景,附带推测解码模块

2026-07-31

Audio8-TTS-Preview-0.6b (Audio8) 0.6B多语言TTS,零样本语音克隆,支持11种语言 Qwen3.6-35B-A3B-Escha-W2 (EschaLabs) 2-bit Qwen3.6-35B-A3B,12.3GB,单卡本地推理 Qwopus3.6-27B-Fusion (KyleHessling1) 融合推理与代码的27B单模型,适合本地编程代理 gemma-4-A4B-98e-v6-coder (ManniX-ITA) Gemma 4 98e coder GGUF量化,本地代码生成与推理 sakthai-context-0.5b-merged (Nanthasit) 边缘工具调用模型,基于 Qwen2.5-0.5B,可在树莓派运行 SakThai-TTS (Nanthasit) 15语TTS GGUF,离线CPU运行 sakthai-vision-7b (Nanthasit) LLaVA-1.5-7B GGUF 量化,本地图像描述与视觉问答 Macaron-V1-Tall (MindLab) Mixture of LoRA 个人助手与工具编码模型 CrisperWhisper2.0-Large (nyralabs) 可控逐字/意图风格的多语言ASR,精准词级时间戳

2026-07-29

Qwen3.6-35B-A3B (LuffyTheFox) 无审查多模态MoE,经Genesis去噪,适合角色扮演和代理 Instella-MoE-16B-A3B-Think (AMD) 全开源 MoE 语言模型,16B 总参/2.8B 激活,面向研究 Qwen-Image-Flash (NVIDIA) 四步DMD2蒸馏,快速文本生成图像,开发者评估

2026-07-28

VibeVoice-ASR-BitNet (Microsoft) 边缘CPU实时多语言语音识别,压缩至1.58GB

2026-07-27

JOSIE-2-4B-Preview (G. Gülmez) 全Apple Silicon训练·推理优先微调·4B预览版 Inflect-Nano-v2 (Owensong) 4M参数本地英文TTS,CPU实时推理

2026-07-26

grug-27b (ProCreations) 27B 令牌高效推理模型,用于智能体与工具调用 Quark-50m-v2 (ThingAI) 43.8M 意英双语对话模型,专为 CPU 环境的意大利语问答设计 antares-1b (fdtn-ai) 1B 参数语言模型,用于轻量推理与微调实验 CLINAMEN-Chat (gokhanturhan) 虚构机构的对话神谕,面向艺术与超虚构创作 Laguna-XS-2.1 (poolside) 代码生成小模型,GGUF 量化版 gemma-4-E2B-it-crap-gguf (matthewhaynesonline) 直接生成可执行ELF hex的文本模型 Mage-Flow-Turbo (Microsoft) 4步蒸馏的4B文本到图像模型,适用快速出图 Inflect-Micro-v2 (owensong) 9.36M 参数完整本地 TTS,固定男声英语言语合成

2026-07-25

Qwen3.5-9B-Defiant-Fable (DavidAU) 无审查9B多模态模型,提升推理与指令跟随 BTL-3 (Bad Theory Labs) 27B 开源代理模型,面向代理编程与结构化工具调用 Laguna-S-2.1 (poolside) poolside 代码模型,GGUF 量化版,适用于本地运行 Grok-3-reasoning-gemma3-4B-GGUF (mradermacher) Grok-3推理蒸馏Gemma3-4B的GGUF量化版

2026-07-24

POCKET-KR-MLX (FINAL-Bench) 35B 韩语模型,在 iPhone/Mac 上用 MLX 本地运行 KAT-Coder-V2.5-Dev (KwaiKAT) 35B MoE编程代理模型,为代码修复与终端任务设计 Qwen3.6-35B-A3B-Genesis-Hermes-V5-GGUF (LuffyTheFox) 无审查多模态 MoE,支持 Hermes 工具调用,为创作者 Mage-Flow-Edit-Turbo (Microsoft) 4B 指令式图像编辑 Turbo 模型,4 步蒸馏推理

2026-07-23

Ornith-35b-MLX-6bit (AtomicChat) 35B MoE MLX 量化,Mac 本地多模态推理 Ornith-35B-MLX (AtomicChat) 面向 Apple Silicon 的多模态量化模型,文本+图像 Nanbeige4.2-3B (Nanbeige) 3B 参数 agent 模型,聚焦工具调用与本地个人助理 Mage-Flow-4B (Microsoft) 紧凑4B原生分辨率文本图像生成与编辑模型 Warmly 0.8B (neureps) 0.8B韩英图像字幕与对话,LoRA适配低内存设备 Laguna-S-2.1 (poolside) 代码生成模型,256K上下文,面向开发者 Laguna-S-2.1-NVFP4 (poolside) 117.6B MoE (8.5B 激活) 代理编码模型,本地设备可运行

2026-07-22

Diamond-1.0 (nineninesix) 语音恢复:劣化音频→44.1kHz近棚音,用于数据集清洗 Ornith-1.0-35B (DeepReinforce) 35B MoE代理编码模型,支持终端代理与工具调用

2026-07-21

GPT-OSS-20B (OpenAI) 2-bit 量化 MLX 模型,专为 Apple Silicon 推理 Nemotron-3-Embed-1B-NVFP4 (NVIDIA) 多语言文本嵌入,NVFP4 量化,专为 RAG 和检索设计

2026-07-20

gear-manual-qwen3-4b (Raindog) 面向硬件音乐设备的本地助手,基于Qwen3-4B微调

2026-07-19

Qwen3.6-27B-Fable-Fusion (DavidAU) 多阶段微调的27B视觉模型,提升推理与创意写作 Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3 (LuffyTheFox) 无审查视觉 MoE 模型,Hermes 工具调用,GGUF 本地推理 Nemotron-3-Embed-8B (NVIDIA) 多语言文本嵌入模型,面向RAG检索与语义搜索。

2026-07-18

GigaAM-Multilingual-MLX INT4 (ai-babai) 俄语及中亚语言离线语音转录,Apple Silicon 用 GigaAM-Multilingual MLX INT8 (ai-babai) Apple Silicon 本地离线俄哈吉乌语 ASR,MLX 量化 GigaAM-Multilingual MLX (ai-babai) Apple Silicon 上俄/哈/吉/乌语离线语音识别 GigaAM-Multilingual (ai-sage) 70+语言语音识别,关注俄语、哈萨克语等小语种 Qwen3.6-35B-A3B (andreaborio) Qwen3.6 MoE 量化版,Apple Metal 加速推理 Nemotron-3-Embed-1B (NVIDIA) 多语言文本嵌入模型,用于语义搜索与 RAG

2026-07-17

MiniCPM5-1B-Claude-Opus-Fable5-V2-Thinking (GnLOLot) 1B 工具调用思考模型 GGUF 量化,本地运行

2026-07-16

MiniCPM5-1B-Thinking (OpenBMB) 1B 思考模型,改进编码与指令遵循,适合本地部署 UncensoredV2 (Kutches) 未审查文本生成模型,卡信息缺失 Dolphin3-Cyber-8B (RavichandranJ) 网络安全领域8B微调模型, 本地离线运行红蓝队工具 Hy-MT2-30B-A3B-APEX (Tencent) 多语言翻译 MoE 模型的 APEX 量化版,供本地 GGUF 推理 FrickFritz-4B-GGUF (fattis) GGUF 量化,解禁角色扮演与图像描述 Bonsai-27B-mlx-1bit (Prism ML) 1-bit 27B 模型, 可在手机和笔记本本地运行推理

2026-07-15

Gemma-4-31B-Animus-V15.0-GGUF (Darkhn) Wings of Fire 世界观角色扮演, 支持链式思维 Qwen3.5-35B-A3B (Qwen) 4-bit MLX 量化,Apple Silicon 本地运行文本生成 Bonsai-27B (Prism ML) 27B 1-bit 量化模型,面向笔记本与手机本地推理 Ternary-Bonsai-27B (Prism ML) 三元权重 27B 推理模型,笔记本本地运行 Nemotron-3-Nano-30B-A3B (NVIDIA) 4bit MoE本地运行于Apple Silicon Ternary Bonsai 27B (prism-ml) 三元2-bit 27B开源模型,笔记本本地运行推理

2026-07-14

Qwen3.6-35B-A3B-VQ (aquaman164) MLX VQ量化35B MoE,适合Apple Silicon本地推理

2026-07-13

Qwythos-9B-v2-GGUF (Empero AI) 修复循环的Qwen3.5推理模型GGUF,支持1M上下文与视觉 Qwythos-9B-v2 (Empero AI) 修复循环生成并保留1M上下文推理能力的研究型模型 M87 (mgwr) Krea-2 Turbo 风格化 LoRA,电影感氛围增强 Qwen3.5-9B-OptiQ-4bit (mlx-community) Apple Silicon 本地 4-bit 混合精度量化文本生成模型 Ornith-1.0-35B-MLX (deepreinforce-ai) Apple Silicon 上 Claude-Code 式本地编码代理

2026-07-11

cohere-transcribe-arabic (CohereLabs) 阿拉伯语自动语音识别 (ASR) 模型 Nemotron-Labs-Audex-2B (NVIDIA) 统一音频-文本语言模型,支持语音识别、翻译、TTS 与音频生成 Krea2 Turbo Style Reference LoRA (Krea) 风格参考 LoRA,将参考图风格注入 Krea2 Turbo 生成

2026-07-10

MiniCPM5-1B-Thinking-GGUF (GnLOLot) 1B 思维链模型 GGUF 量化,本地轻量代码与指令任务 ThinkingCap-Qwen3.6-27B (bottlecapai) 视觉语言模型,思考令牌减半,GGUF量化,适合本地运行 Qwen3.6-27B-Heretic-GGUF (darkc0de) Claude Opus推理蒸馏并反审查的27B模型GGUF版 Gepard-1.0 (nineninesix) 流式自回归 TTS,面向实时对话与语音代理

2026-07-09

Supra-Router-51M (SupraLabs) 51M 参数边缘路由器, 判断提示词复杂度并分发至本地或云端模型 Kokoro-82M (hexgrad) 82M 参数轻量 TTS 模型,支持多语言,可本地部署 NVIDIA-Nemotron-Labs-3-Puzzle-75B-A9B (NVIDIA) 面向高吞吐推理的压缩 MoE 模型,用于交互式推理与高并发部署 Nemotron-Labs-Audex-30B-A3B (NVIDIA) 音频-文本统一LLM,兼顾文本推理与语音/音频生成

2026-07-08

LTX-Best-Face-ID (Alissonerdx) LTX-2.3 身份保持 LoRA,单参考图加提示生成人物视频

2026-07-07

Grug-12B (kai-os) 紧凑推理微调,减少冗余推理轨迹,降低推理token消耗

2026-07-06

MaralGPT-Mythos-9B (MaralGPT) 无审查 Qwen3.5-9B 微调,用于网络安全与生物医学 Krea-2 Depth ControlNet (Patil) 深度条件图像生成,保持输入图像3D结构,用于风格迁移与内容变换 Nova-1-Standard-1.3B (Smilyai Labs) 1.3B MoD对话模型,支持ChatML与代码/数学生成 Qwen3.6-35B-A3B (Qwen) 三元专家量化版,9.4 GB 全量跑在 16 GB Mac 上 paw-programs (programasweights) 用途未公开

2026-07-05

Gemma-4-12B Agentic v2 (yuxinlu1) 编程与工具调用代理微调,供开发者本地使用

2026-07-04

Gemma4-Gutenberg-31B-Heretic-mlx-8Bit (ailexleon) MLX 8-bit 量化英文创意写作模型,适合故事小说生成 Sun-Direction LoRA (eric-venti-seeds) 为Flux.2 Klein 9B图像指定阳光方向,球体参考工作流 Laguna XS 2.1 (poolside) 33B MoE 编码模型,3B 激活,为本地代理与长任务设计

2026-07-03

Higgs TTS 3 (Boson AI) 对话式语音合成,100+语种,零样本克隆与内联控制 Ornith-1.0-35B (DeepReinforce) 35B开源编码代理模型,原生工具调用与推理链 Ornith-1.0-9B-MTP (protoLabs) Ornith-9B MTP GGUF:llama.cpp推测解码加速

2026-07-02

Gemma4-26B-A4B (HauhauCS) 无审查Gemma4-26B MoE,适用于代理编码与创意写作 Huihui-GLM-5.2-GGUF (huihui-ai) 移除安全过滤的GLM-5.2 GGUF,供研究实验用 Huihui-Qwythos-9B-1M (huihui-ai) 未审查 1M 上下文 Qwen3.5 微调,支持工具调用 Nemotron-Labs-TwoTower-30B-A3B (NVIDIA) 双塔扩散LLM,块并行解码,2.42x生成吞吐量 Qwen3.6-27B-NVFP4 (NVIDIA) Qwen3.6-27B NVFP4 量化,面向 vLLM 部署与推理

2026-07-01

Qwopus-3.6-35B-A3B-Coder (Jackrong) 关闭思考的编码代理模型,降低 token 延迟,适合本地工作流 LFM2.5-8B-A1B-APEX (LiquidAI / LocalAI) 8B参数1B激活MoE,消费级GPU可运行的APEX量化 Krea-2-Turbo (Krea) 12B 文本到图像扩散模型,GGUF 量化版,用于本地生成

2026-06-30

BugTraceAI-CORE-Ultra-27B (BugTraceAI) 生成漏洞利用与安全工具,面向攻防研究者 Gemma-4-12B GGUF 合集 (rahul7star) Gemma 4 12B/3B GGUF 量化集合,供本地聊天与代码任务 Unlimited-OCR (Baidu) 3B 视觉语言 OCR 模型,文档解析与 Markdown 转换

2026-06-29

LFM2.5-230M (LiquidAI) 混合架构边缘设备模型,用于设备端文本生成

2026-06-27

Ornith-1.0-35B (DeepReinforce) 用于代理式编码的自改进开源 MoE,35B 总参、低激活,量化后本地可跑 Ornith-1.0-9B (DeepReinforce) 面向编程代理的开源文本生成模型;为单卡部署设计 Ornith-1.0-9B (DeepReinforce) 自改进编码代理模型,9B 单卡部署

2026-06-26

LFM2.5-230M (LiquidAI) 230M混合架构,为边缘设备推理与代理任务设计 Ornith-1.0-35B (DeepReinforce) 轻量级代理编码开源模型,单 GPU 可部署 Qwen3.6-27B-Uncensored (AEON-7/mradermacher) 27B 无审查多模态混合模型,本地创作者使用 Qwen3.6-27B-AEON-Uncensored (AEON-7) 无审查的27B视觉语言模型,用于多模态对话与图像理解 Gemma-4-31B-it (Google) IQ2_M 31B 多模态 Agent,10 GiB 本地运行 Mythos-nano (squ11z1) 3B无审查推理模型,专注数学与竞赛编程

2026-06-25

Krea2-FP8 (KREA) Krea 2 Turbo 的 FP8 量化版,16GB 显存可用 Mythos-nano (squ11z1) 轻量推理模型,专注数学与代码任务的本地运行

2026-06-24

Gemma4-12B-Uncensored (HauhauCS) 解除审查的Gemma4多模态模型,面向代理编码与创意写作 Qwopus3.6-27B-Coder (Jackrong) 27B编码器GGUF,兼容多种工具历史格式,供本地开发者使用 Qwen3.6-27b-Fable5 (hotdogs) Qwen3.6-27B的LoRA微调,用于故事与寓言生成 Krea-2-Raw (Krea) 12B 图像生成基座,用于 LoRA 微调训练 Krea-2-Turbo (Krea) 12B 扩散 Transformer 文生图模型,面向创作者与开发者

2026-06-23

Qwythos-9B (Empero) 开源 9B 推理模型,不审查,支持 1M 上下文和函数调用 Qwable-3.6-35b (Mia-AiLab) Qwen3.6-35b 全量微调,强化结构化推理与代码助手 Huihui-gemma-4-12B-coder-abliterated (huihui-ai) 未审查版 Gemma 代码模型,用于编程与推理,已去除拒答 FastContext-1.0-4B-RL (Microsoft) 为编码代理提供仓库探索与精确文件引用

2026-06-22

Qwythos-9B-Claude-Mythos-5-1M (Empero) 基于Qwen3.5的推理模型,1M上下文,支持函数调用 ideogram_4_turbotime_lora (ostris) Ideogram 4 加速 LoRA,2 步出图,无需 CFG GLM-5.2-GGUF (Unsloth) 1M上下文开源模型,面向长文本处理与代码生成

2026-06-20

SIQ-1-35B (AlexWortega) 3B活跃参数的通用Agent,自动研究/编程/推理 Inflect-Nano-v1 (owensong) 超小型英文TTS,总4.63M参数,适合本地/嵌入式实验 Laguna M.1 云端旗舰,225B 参数稀疏 MoE,专为智能体编程和长周期任务设计 Gemma-4-12B-it-LWQ6 (wepiqx) 混合量化Gemma-4-12B,8GB显存Pascal GPU代码生成 gemma-4-12B-agentic-v2 (yuxinlu1) 本地离线编码与工具使用Agent,仅需4.5GB显存即可运行

2026-06-19

LFM2.5-ColBERT-350M (LiquidAI) 11 语言 ColBERT 检索模型,专为短文本 RAG 设计 LFM2.5-Embedding-350M (LiquidAI) 11语种双编码器,面向端侧语义检索

2026-06-18

Gemma-4-31B-StyleTune (Gryphe) Gemma 4 31B风格微调,陈词减60%,角色扮演与创意写作。 Qwopus-3.6-27B-Coder (Jackrong) 面向代理编码与工具调用的27B推理模型 Qwen3.6-27B-MTP-pi-tune (bytkim) 面向无思考代理编码的MTP微调版,本地GGUF推理

2026-06-17

Qwable-27B (Mia-AiLab) 基于 Qwen3.6 的推理与代码微调模型,面向本地部署与结构化助手 Qwable-v1 (lordx64) Qwen3.6基MoE代理编码模型(3B激活)

2026-06-16

PP-OCRv6_medium_det (PaddlePaddle) 轻量级多语言文本检测模型,48语种,服务端/边缘可用 FastContext-1.0-4B-SFT (Microsoft) 轻量仓库探索子代理,供编码代理按需调用,减少 token 消耗 prism-coder-14b (dcostenco) 基于 Qwen3 的 14B 代码模型 GGUF 量化,本地可跑 prism-coder-14b (mradermacher) 基于 Qwen3 的代码模型,GGUF 量化版,适合本地运行

2026-06-15

Z-Image-Engineer-V6 (BennyDaBall) 4B 提示词增强与 Z-Image 文本编码器,本地双用途 DiffusionGemma-26B-A4B-it-NVFP4 (NVIDIA) 扩散多模态文本生成,3.8B活跃参数,NVFP4量化

2026-06-14

niko_orchestrator_gguf (SAi404) Llama-3.2-3B 微调,GGUF 格式,给本地推理用户 ZONOS2 (Zyphra) 基于 MoE 的多语言 TTS,支持零样本克隆与流式生成 Averroes-Q-Instruct (hayulalab) Qwen2 架构的阿/英指令模型 GGUF 量化 North-Mini-Code-1.0 (Cohere) 30B总/3B激活的MoE代码代理模型,专注代码生成与终端任务 Gemma4-12B-Coder (yuxinlu1) 本地 Python 编程模型,离线解决算法问题

2026-06-13

Qwopus3.6-27B-Coder (Jackrong) 27B编码与工具调用推理模型 (GGUF) Quasar-Preview (silx-ai) 18B MoE预览模型,面向Bittensor SN24研究蒸馏 DiffusionGemma-26B-A4B-it (Google) 离散扩散文本生成,支持图像/视频输入,低延迟

2026-06-12

LFM2.5-1.2B-JP (LiquidAI) 日英双语聊天模型,适合代理工作流与工具使用 Delphi-25B (Marin Community) Delphi扩展律研究基座,25B参数,终版模型

2026-06-11

LFM2.5-Audio-1.5B-JP (LiquidAI) 日语端到端语音对话,1.5B轻量实时交互 gemma-4-98e-coderx-GGUF (ManniX-ITA) LCB-medium 99%,12GB 级代码专家量化包 Gemma-4-31B-it (Google) 31B 多模态模型,支持图像输入,GGUF 量化版 Gemma-4-E2B-Heretic (DuoNeural) Gemma 4 视觉模型 abliteration 版 GGUF 量化 Harness-1 (pat-jj) 20B搜索智能体,对标前沿检索性能 Gemma-4-31B-QAT-GGUF (unsloth) Gemma 4 31B 量化图文模型,支持工具调用,本地部署

2026-06-10

North-Mini-Code-1.0 (CohereLabs) 30B-A3B 代码生成与 agent 模型,面向软件工程终端任务 Gemma-4-12B-OBLITERATED (OBLITERATUS) 零拒绝消融Gemma 4,供对齐研究与红队测试

2026-06-09

Ideogram-4-NF4 (Ideogram) Ideogram 4 官方 NF4 量化,低显存本地出图

2026-06-08

ZwZ-7B (inclusionAI) 7B 视觉语言模型 GGUF 量化包,适合本地 VQA 与对话 Gemma-4-26B-A4B-QAT-GGUF (Unsloth) Gemma 4 26B MoE 量化版,用于本地图像与文本推理

2026-06-07

Qwen3.6-27B-MTPLX (Youssofal) Qwen3.6-27B 的 MLX 推理加速版供苹果芯片 Gemma-4-12B-it-QAT-Q4_0 (Google) Gemma 4 12B GGUF 量化版,本地多模态推理。 ideogram-4-fp8 (ideogram-ai) 文本到图像生成模型,Ideogram 4 的 FP8 量化版本 Gemma-4-12B-it-QAT (Google) 12B开源对话模型QAT量化,可本地CPU/GPU推理 Gemma-4-26B-A4B (Google) 量化 Gemma-4,本地运行对话与指令 Gemma-4-31B-it-QAT (Google) Google 31B QAT 对话模型,GGUF 本地部署 Gemma-4-E2B-it (Google) Gemma 4 2B 指令 GGUF,本地推理 Gemma-4-E4B-it-QAT (Google) Google Gemma 4 量化版,本地消费级硬件推理 Qwen3.5-0.8B-OptiQ-4bit (mlx-community) 苹果芯片4-bit MLX 量化 Qwen3.5-0.8B Qwen3.5-2B-OptiQ-4bit (mlx-community) 4-bit混合精度MLX量化Qwen3.5-2B,苹果芯片推理 Qwen3.6-27B-OptiQ-4bit (mlx-community) Apple Silicon的Qwen3.6-27B 4bit混合量化版 Qwen3.6-35B-A3B-OptiQ-4bit (mlx-community) Apple Silicon 4-bit MLX混精量化+MTP投机解码 gemma-4-12B-it-qat-GGUF (Unsloth) Google Gemma 4 12B QAT GGUF,本地多模态推理

2026-06-06

Higgs-Audio-v3-TTS-4B (Boson AI) 语音对话TTS:100+语种、零样克隆、情感/风格内联控制 JoyAI-Echo (JD) 分钟级多镜头音视频长视频生成,面向研究者

2026-06-05

Mellum2-12B-A2.5B-Instruct (JetBrains) 直接回答的指令模型,用于交互聊天、代码和工具调用 MisoTTS-8B (MisoLabs) 基于 Sesame CSM 的对话 TTS 模型,支持语音上下文延续 Lean Finder (delta-lab-ai) 面向数学证明的语义搜索嵌入模型,用于查找 mathlib 定理

2026-06-04

NAVA-6.3B (Baidu) 文本/图像生成音视频同步内容,支持多说话人音色控制 HelixLM-40M-ep1 (david-thrower) 循环异构图语言模型,用于个性化微调与端侧推理 gemma-4-12B-it (Google) Google Gemma 4 12B 指令模型,GGUF 量化版本 Gemma-4-12B-GGUF (Unsloth) 12B 多模态模型,支持图文音频输入,本地 GGUF 量化部署

2026-06-03

Mellum2-12B-A2.5B-Thinking (JetBrains) 思考型助手,在<think>块中输出推理链后给出最终答案 LFM2.5-8B-A1B (Liquid AI) 8.3B总参/1.5B活跃,面向端侧个人助手的混合架构模型

2026-06-02

NAVA (Baidu) 6.3B 文本生成同步音视频,支持多说话人音色控制 Cosmos3-Super-Text2Image (nvidia) 文本生成高保真图像,面向物理AI与创作

2026-06-01

Qwen3.5-9B (Qwen) Qwen3.5-9B MoQ量化版,MTP推测解码,适合本地快速生成

2026-05-31

Qwen3.6-35B-A3B-NVFP4 (NVIDIA) Qwen3.6-35B-A3B FP4量化版,面向vLLM高效推理

2026-05-29

LFM2.5-8B-A1B (LiquidAI) 混合架构边缘语言模型,GGUF 量化,供 llama.cpp 部署 LFM2.5-8B-A1B (LiquidAI) 端侧部署的混合MoE模型,用于工具调用与多语言助理 Bonsai-Image-Binary-4B (Prism ML) 1-bit量化文生图模型,专为Apple Silicon本地运行 Bonsai Image Ternary 4B (Prism ML) 1.21GB三元文生图模型,4步采样,本地GPU运行 Bonsai-Image-4B (Prism ML) 1.21GB 三元文生图扩散模型,苹果芯片本地运行

2026-05-27

BitCPM-CANN-8B (OpenBMB) 昇腾原生1.58-bit三元LLM,推理内存降6x,保持95.7%性能

2026-05-26

aro-coder-4bit (ARO-Lang) 为ARO语言微调的代码生成器,4bit量化,供ARO DSL开发者使用 FLUX.1-dev (BFL) 文本到图像生成,用于开发者与创作者的视觉内容创建 PiD (NVIDIA) 像素扩散解码器,将潜在表征一步超分至2K/4K图像 Mega-ASR (THU) 面向远场、混响、重叠语音等严重声学退化的鲁棒语音识别

2026-05-25

speaker-diarization-3.1 (pyannote) 多说话人分割模型,从音频中区分谁在何时说话

2026-05-24

Qwopus3.6-27B-v2 (Jackrong) Claude CoT 逆推微调的推理模型,支持视觉与工具调用 Qwopus3.6-27B-v2-MTP-GGUF (Jackrong) 多Token预测推理模型,面向编码、数学、DevOps开发者 Qwen3.6-27B (OBLITERATUS) 移除拒绝回路,能力保持,本地全栈部署 Lens (Microsoft) 3.8B文本生成图像基础模型,高效训练与高分辨率生成

2026-05-23

Lens-Turbo (Microsoft) 3.8B 高效文生图,4 步蒸馏,为开发者与创作者快速生成

2026-05-22

Meta-Llama-3-8B-Instruct-4bit (mlx-community) Llama-3-8B 4-bit版,M系列芯片本地推理 Ternary-Bonsai-8B (Prism ML) 三元1.58-bit量化8B模型,苹果芯片本地推理

2026-05-21

Qwopus3.5-9B-Coder-MTP (Jackrong) 9B多令牌预测代码模型,GGUF量化,面向代码推理 MiniMax-M2.7 (MiniMax) MiniMax M2.7 GGUF量化版,适合本地部署与实验 Nemotron-3-Nano-Omni-30B-A3B (NVIDIA) NVIDIA 多模态推理模型 GGUF 量化版,本地推理用 Qwen3.6-27B (Qwen) 27B参数GGUF版,本地AI原型开发 Qwen3.6-35B-A3B (Qwen) 35B MoE仅3B激活的GGUF量化版,适合本地中文开发 gemma-4-26B-A4B-it (Google) 26B总参/4B活跃的MoE指令模型,面向本地推理 Gemma-4-31B-it-GGUF (LM Studio) Google 31B 指令模型 GGUF 量化版,本地消费级硬件推理 gemma-4-E2B-it-GGUF (LM Studio) 谷歌 Gemma 4 指令模型 GGUF 量化版,本地高效部署 gemma-4-E4B-it (Google) Gemma4-4B-it 量化版, 本地轻量推理 Granite-4.1-30B (IBM) IBM Granite 30B GGUF量化, 本地部署与推理 Granite-4.1-3B-GGUF (IBM) IBM Granite 4.1 3B GGUF量化,本地推理与边缘部署 Granite-4.1-8B-GGUF (IBM) IBM Granite 4.1 8B的GGUF量化,用于本地推理 Llama-2-7b-chat-mlx (mlx-community) Apple芯片上本地运行的Llama2 7B对话模型 NuExtract3 (NuMind) 文档结构化提取和Markdown转换的4B视觉语言模型 Nemotron-Labs-Diffusion-14B (NVIDIA) 三模式 LM (AR/扩散/自推测),为 AI 应用开发者提供高效生成 Qwen3.5-9B-MTP-GGUF (unsloth) Qwen3.5-9B 多模态模型,MTP 投机解码,本地快速运行

2026-05-20

SuperGemma4-26B (Jiunsong) Gemma4 26B 无审查 MLX, 本地代理加速 LTX-2.3-Workflows (RuneXX) LTX-2.3模型的ComfyUI工作流集合,用于图像/视频生成。 XEUS (CMU WAVLab) 覆盖4000+语言的语音基础模型,供ASR/翻译微调 Whisper Large v3 MLX (mlx-community) Apple Silicon 上运行的 Whisper 语音识别模型 Whisper-large-v3-turbo (mlx-community) Mac端Whisper large-v3-turbo,MLX低延迟转写 Bonsai-8B-mlx-1bit (PrismML) Apple Silicon 的 1-bit LLM,端侧极低内存推理 Minimalism (salakash) 为开发者输出最少代码行的可运行代码 HRM-Text-1B (sapientinc) 1B预对齐前缀LM,用前缀条件做结构化输出与推理

2026-05-19

Qwen3.6-35B-A3B-GGUF (Unsloth) 支持MTP加速的3B激活参数量化视觉语言模型,面向本地编程代理

2026-05-18

Irodori-TTS-500M-v3 (Aratako) 日语TTS,表情符号控制风格,零样本克隆 Qwen3.6-27B-Heretic-Uncensored-FINETUNE-NEO-CODE-Di-IMatrix-MAX-GGUF (DavidAU) 解禁版Qwen3.6-27B量化模型,为创意写作与代码而生 Gemma-4-E4B-Aggressive (HauhauCS) 无审查的Gemma 4多模态模型,适合内容生成开发者 Gemma4-26B-A4B-Uncensored-Balanced (HauhauCS) Gemma4 无审查多模态 MoE,面向创意写作与角色扮演 Qwopus3.5-9B-Coder (Jackrong) 面向Agent编码与工具调用的9B视觉推理模型 SuperGemma4-26B-Uncensored (Jiunsong) 无审查Gemma 4 26B GGUF,适合苹果硅本地快速推理 AsymFLUX.2-klein-9B (Stanford) 像素空间文生图模型,基于AsymFlow,适合文字渲染与细节生成 jina-embeddings-v5-omni-small (Jina) 多模态嵌入模型,支持文本/图像/视频/音频 Qwen3.6-27B-GGUF (unsloth) Qwen3.6-27B GGUF量化版,面向本地部署与边缘推理 Qwen3.6-27B-MTP-GGUF (Unsloth) Qwen3.6-27B的MTP量化版,推理速度1.5-2倍提升 Qwen3.6-35B-A3B-GGUF (Unsloth) Qwen3.6 MoE GGUF 量化版,用于本地代理编程与多模态推理 LTX2.3-10Eros-GGUF (vantagewithai) LTX2.3 微调的图生视频 GGUF 模型,用于 ComfyUI

2026-05-16

Qwen3.6-40B (DavidAU) 多模态无审查推理模型,面向代码与视觉应用 Nandi-Mini-600M (FrontiersMind) 600M参数早期检查点,面向低资源多语言部署 Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive 35B MoE多模态去审查模型,适合本地无限制输出 Dramabox (ResembleAI) 通用文本转语音,面向配音与有声内容制作者 Juggernaut-Z-Image (RunDiffusion) 文本到图像扩散模型,面向 AI 应用构建者 scenema-audio (ScenemaAI) TTS 模型,面向语音合成开发者 Z-Anime (SeeSee21) 动漫风格图像生成,面向二次元AI应用开发者 Sulphur-2-base (SulphurAI) 无审查文本/图像生成视频,基于LTX2.3 Supertonic 3 (Supertone) 31种语言本地TTS,面向AI应用开发者的语音合成 Leanly_AI (jackxinning) 通用问答模型,适合知识型对话与事实查询。 OmniVoice (k2-fsa) 为开发者提供600+语言零样本语音合成 Sulphur-2-Base (vantagewithai) 图像到视频基座模型,GGUF量化版,适合本地推理