Access · 需代理

共 225 个 (跨 61 天)

2026-07-21

GPT-OSS-20B (OpenAI) 2-bit 量化 MLX 模型,专为 Apple Silicon 推理 Nemotron-3-Embed-1B-NVFP4 (NVIDIA) 多语言文本嵌入,NVFP4 量化,专为 RAG 和检索设计

2026-07-20

gear-manual-qwen3-4b (Raindog) 面向硬件音乐设备的本地助手,基于Qwen3-4B微调

2026-07-19

Qwen3.6-27B-Fable-Fusion (DavidAU) 多阶段微调的27B视觉模型,提升推理与创意写作 Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3 (LuffyTheFox) 无审查视觉 MoE 模型,Hermes 工具调用,GGUF 本地推理 Nemotron-3-Embed-8B (NVIDIA) 多语言文本嵌入模型,面向RAG检索与语义搜索。

2026-07-18

GigaAM-Multilingual-MLX INT4 (ai-babai) 俄语及中亚语言离线语音转录,Apple Silicon 用 GigaAM-Multilingual MLX INT8 (ai-babai) Apple Silicon 本地离线俄哈吉乌语 ASR,MLX 量化 GigaAM-Multilingual MLX (ai-babai) Apple Silicon 上俄/哈/吉/乌语离线语音识别 GigaAM-Multilingual (ai-sage) 70+语言语音识别,关注俄语、哈萨克语等小语种 Qwen3.6-35B-A3B (andreaborio) Qwen3.6 MoE 量化版,Apple Metal 加速推理 Nemotron-3-Embed-1B (NVIDIA) 多语言文本嵌入模型,用于语义搜索与 RAG

2026-07-17

MiniCPM5-1B-Claude-Opus-Fable5-V2-Thinking (GnLOLot) 1B 工具调用思考模型 GGUF 量化,本地运行

2026-07-16

MiniCPM5-1B-Thinking (OpenBMB) 1B 思考模型,改进编码与指令遵循,适合本地部署 Dolphin3-Cyber-8B (RavichandranJ) 网络安全领域8B微调模型, 本地离线运行红蓝队工具 UncensoredV2 (Kutches) 未审查文本生成模型,卡信息缺失 Hy-MT2-30B-A3B-APEX (Tencent) 多语言翻译 MoE 模型的 APEX 量化版,供本地 GGUF 推理 FrickFritz-4B-GGUF (fattis) GGUF 量化,解禁角色扮演与图像描述 Bonsai-27B-mlx-1bit (Prism ML) 1-bit 27B 模型, 可在手机和笔记本本地运行推理

2026-07-15

Gemma-4-31B-Animus-V15.0-GGUF (Darkhn) Wings of Fire 世界观角色扮演, 支持链式思维 Nemotron-3-Nano-30B-A3B (NVIDIA) 4bit MoE本地运行于Apple Silicon Qwen3.5-35B-A3B (Qwen) 4-bit MLX 量化,Apple Silicon 本地运行文本生成 Bonsai-27B (Prism ML) 27B 1-bit 量化模型,面向笔记本与手机本地推理 Ternary-Bonsai-27B (Prism ML) 三元权重 27B 推理模型,笔记本本地运行 Ternary Bonsai 27B (prism-ml) 三元2-bit 27B开源模型,笔记本本地运行推理

2026-07-14

Qwen3.6-35B-A3B-VQ (aquaman164) MLX VQ量化35B MoE,适合Apple Silicon本地推理

2026-07-13

Qwythos-9B-v2-GGUF (Empero AI) 修复循环的Qwen3.5推理模型GGUF,支持1M上下文与视觉 Qwythos-9B-v2 (Empero AI) 修复循环生成并保留1M上下文推理能力的研究型模型 M87 (mgwr) Krea-2 Turbo 风格化 LoRA,电影感氛围增强 Ornith-1.0-35B-MLX (deepreinforce-ai) Apple Silicon 上 Claude-Code 式本地编码代理 Qwen3.5-9B-OptiQ-4bit (mlx-community) Apple Silicon 本地 4-bit 混合精度量化文本生成模型

2026-07-11

cohere-transcribe-arabic (CohereLabs) 阿拉伯语自动语音识别 (ASR) 模型 Nemotron-Labs-Audex-2B (NVIDIA) 统一音频-文本语言模型,支持语音识别、翻译、TTS 与音频生成 Krea2 Turbo Style Reference LoRA (Krea) 风格参考 LoRA,将参考图风格注入 Krea2 Turbo 生成

2026-07-10

MiniCPM5-1B-Thinking-GGUF (GnLOLot) 1B 思维链模型 GGUF 量化,本地轻量代码与指令任务 ThinkingCap-Qwen3.6-27B (bottlecapai) 视觉语言模型,思考令牌减半,GGUF量化,适合本地运行 Qwen3.6-27B-Heretic-GGUF (darkc0de) Claude Opus推理蒸馏并反审查的27B模型GGUF版 Gepard-1.0 (nineninesix) 流式自回归 TTS,面向实时对话与语音代理

2026-07-09

Supra-Router-51M (SupraLabs) 51M 参数边缘路由器, 判断提示词复杂度并分发至本地或云端模型 Kokoro-82M (hexgrad) 82M 参数轻量 TTS 模型,支持多语言,可本地部署 NVIDIA-Nemotron-Labs-3-Puzzle-75B-A9B (NVIDIA) 面向高吞吐推理的压缩 MoE 模型,用于交互式推理与高并发部署 Nemotron-Labs-Audex-30B-A3B (NVIDIA) 音频-文本统一LLM,兼顾文本推理与语音/音频生成

2026-07-08

LTX-Best-Face-ID (Alissonerdx) LTX-2.3 身份保持 LoRA,单参考图加提示生成人物视频

2026-07-07

Grug-12B (kai-os) 紧凑推理微调,减少冗余推理轨迹,降低推理token消耗

2026-07-06

MaralGPT-Mythos-9B (MaralGPT) 无审查 Qwen3.5-9B 微调,用于网络安全与生物医学 Krea-2 Depth ControlNet (Patil) 深度条件图像生成,保持输入图像3D结构,用于风格迁移与内容变换 Qwen3.6-35B-A3B (Qwen) 三元专家量化版,9.4 GB 全量跑在 16 GB Mac 上 paw-programs (programasweights) 用途未公开 Nova-1-Standard-1.3B (Smilyai Labs) 1.3B MoD对话模型,支持ChatML与代码/数学生成

2026-07-05

Gemma-4-12B Agentic v2 (yuxinlu1) 编程与工具调用代理微调,供开发者本地使用

2026-07-04

Sun-Direction LoRA (eric-venti-seeds) 为Flux.2 Klein 9B图像指定阳光方向,球体参考工作流 Gemma4-Gutenberg-31B-Heretic-mlx-8Bit (ailexleon) MLX 8-bit 量化英文创意写作模型,适合故事小说生成 Laguna XS 2.1 (poolside) 33B MoE 编码模型,3B 激活,为本地代理与长任务设计

2026-07-03

Higgs TTS 3 (Boson AI) 对话式语音合成,100+语种,零样本克隆与内联控制 Ornith-1.0-35B (DeepReinforce) 35B开源编码代理模型,原生工具调用与推理链 Ornith-1.0-9B-MTP (protoLabs) Ornith-9B MTP GGUF:llama.cpp推测解码加速

2026-07-02

Gemma4-26B-A4B (HauhauCS) 无审查Gemma4-26B MoE,适用于代理编码与创意写作 Huihui-GLM-5.2-GGUF (huihui-ai) 移除安全过滤的GLM-5.2 GGUF,供研究实验用 Huihui-Qwythos-9B-1M (huihui-ai) 未审查 1M 上下文 Qwen3.5 微调,支持工具调用 Nemotron-Labs-TwoTower-30B-A3B (NVIDIA) 双塔扩散LLM,块并行解码,2.42x生成吞吐量 Qwen3.6-27B-NVFP4 (NVIDIA) Qwen3.6-27B NVFP4 量化,面向 vLLM 部署与推理

2026-07-01

Qwopus-3.6-35B-A3B-Coder (Jackrong) 关闭思考的编码代理模型,降低 token 延迟,适合本地工作流 LFM2.5-8B-A1B-APEX (LiquidAI / LocalAI) 8B参数1B激活MoE,消费级GPU可运行的APEX量化 Krea-2-Turbo (Krea) 12B 文本到图像扩散模型,GGUF 量化版,用于本地生成

2026-06-30

Gemma-4-12B GGUF 合集 (rahul7star) Gemma 4 12B/3B GGUF 量化集合,供本地聊天与代码任务 Unlimited-OCR (Baidu) 3B 视觉语言 OCR 模型,文档解析与 Markdown 转换 BugTraceAI-CORE-Ultra-27B (BugTraceAI) 生成漏洞利用与安全工具,面向攻防研究者

2026-06-29

LFM2.5-230M (LiquidAI) 混合架构边缘设备模型,用于设备端文本生成

2026-06-27

Ornith-1.0-35B (DeepReinforce) 用于代理式编码的自改进开源 MoE,35B 总参、低激活,量化后本地可跑 Ornith-1.0-9B (DeepReinforce) 面向编程代理的开源文本生成模型;为单卡部署设计 Ornith-1.0-9B (DeepReinforce) 自改进编码代理模型,9B 单卡部署

2026-06-26

LFM2.5-230M (LiquidAI) 230M混合架构,为边缘设备推理与代理任务设计 Ornith-1.0-35B (DeepReinforce) 轻量级代理编码开源模型,单 GPU 可部署 Qwen3.6-27B-AEON-Uncensored (AEON-7) 无审查的27B视觉语言模型,用于多模态对话与图像理解 Qwen3.6-27B-Uncensored (AEON-7/mradermacher) 27B 无审查多模态混合模型,本地创作者使用 Gemma-4-31B-it (Google) IQ2_M 31B 多模态 Agent,10 GiB 本地运行 Mythos-nano (squ11z1) 3B无审查推理模型,专注数学与竞赛编程

2026-06-25

Krea2-FP8 (KREA) Krea 2 Turbo 的 FP8 量化版,16GB 显存可用 Mythos-nano (squ11z1) 轻量推理模型,专注数学与代码任务的本地运行

2026-06-24

Gemma4-12B-Uncensored (HauhauCS) 解除审查的Gemma4多模态模型,面向代理编码与创意写作 Qwopus3.6-27B-Coder (Jackrong) 27B编码器GGUF,兼容多种工具历史格式,供本地开发者使用 Qwen3.6-27b-Fable5 (hotdogs) Qwen3.6-27B的LoRA微调,用于故事与寓言生成 Krea-2-Raw (Krea) 12B 图像生成基座,用于 LoRA 微调训练 Krea-2-Turbo (Krea) 12B 扩散 Transformer 文生图模型,面向创作者与开发者

2026-06-23

Qwable-3.6-35b (Mia-AiLab) Qwen3.6-35b 全量微调,强化结构化推理与代码助手 Qwythos-9B (Empero) 开源 9B 推理模型,不审查,支持 1M 上下文和函数调用 Huihui-gemma-4-12B-coder-abliterated (huihui-ai) 未审查版 Gemma 代码模型,用于编程与推理,已去除拒答 FastContext-1.0-4B-RL (Microsoft) 为编码代理提供仓库探索与精确文件引用

2026-06-22

Qwythos-9B-Claude-Mythos-5-1M (Empero) 基于Qwen3.5的推理模型,1M上下文,支持函数调用 ideogram_4_turbotime_lora (ostris) Ideogram 4 加速 LoRA,2 步出图,无需 CFG GLM-5.2-GGUF (Unsloth) 1M上下文开源模型,面向长文本处理与代码生成

2026-06-20

SIQ-1-35B (AlexWortega) 3B活跃参数的通用Agent,自动研究/编程/推理 Inflect-Nano-v1 (owensong) 超小型英文TTS,总4.63M参数,适合本地/嵌入式实验 Laguna M.1 云端旗舰,225B 参数稀疏 MoE,专为智能体编程和长周期任务设计 Gemma-4-12B-it-LWQ6 (wepiqx) 混合量化Gemma-4-12B,8GB显存Pascal GPU代码生成 gemma-4-12B-agentic-v2 (yuxinlu1) 本地离线编码与工具使用Agent,仅需4.5GB显存即可运行

2026-06-19

LFM2.5-ColBERT-350M (LiquidAI) 11 语言 ColBERT 检索模型,专为短文本 RAG 设计 LFM2.5-Embedding-350M (LiquidAI) 11语种双编码器,面向端侧语义检索

2026-06-18

Gemma-4-31B-StyleTune (Gryphe) Gemma 4 31B风格微调,陈词减60%,角色扮演与创意写作。 Qwopus-3.6-27B-Coder (Jackrong) 面向代理编码与工具调用的27B推理模型 Qwen3.6-27B-MTP-pi-tune (bytkim) 面向无思考代理编码的MTP微调版,本地GGUF推理

2026-06-17

Qwable-27B (Mia-AiLab) 基于 Qwen3.6 的推理与代码微调模型,面向本地部署与结构化助手 Qwable-v1 (lordx64) Qwen3.6基MoE代理编码模型(3B激活)

2026-06-16

PP-OCRv6_medium_det (PaddlePaddle) 轻量级多语言文本检测模型,48语种,服务端/边缘可用 FastContext-1.0-4B-SFT (Microsoft) 轻量仓库探索子代理,供编码代理按需调用,减少 token 消耗 prism-coder-14b (dcostenco) 基于 Qwen3 的 14B 代码模型 GGUF 量化,本地可跑 prism-coder-14b (mradermacher) 基于 Qwen3 的代码模型,GGUF 量化版,适合本地运行

2026-06-15

Z-Image-Engineer-V6 (BennyDaBall) 4B 提示词增强与 Z-Image 文本编码器,本地双用途 DiffusionGemma-26B-A4B-it-NVFP4 (NVIDIA) 扩散多模态文本生成,3.8B活跃参数,NVFP4量化

2026-06-14

niko_orchestrator_gguf (SAi404) Llama-3.2-3B 微调,GGUF 格式,给本地推理用户 ZONOS2 (Zyphra) 基于 MoE 的多语言 TTS,支持零样本克隆与流式生成 Averroes-Q-Instruct (hayulalab) Qwen2 架构的阿/英指令模型 GGUF 量化 Gemma4-12B-Coder (yuxinlu1) 本地 Python 编程模型,离线解决算法问题 North-Mini-Code-1.0 (Cohere) 30B总/3B激活的MoE代码代理模型,专注代码生成与终端任务

2026-06-13

Qwopus3.6-27B-Coder (Jackrong) 27B编码与工具调用推理模型 (GGUF) Quasar-Preview (silx-ai) 18B MoE预览模型,面向Bittensor SN24研究蒸馏 DiffusionGemma-26B-A4B-it (Google) 离散扩散文本生成,支持图像/视频输入,低延迟

2026-06-12

LFM2.5-1.2B-JP (LiquidAI) 日英双语聊天模型,适合代理工作流与工具使用 Delphi-25B (Marin Community) Delphi扩展律研究基座,25B参数,终版模型

2026-06-11

LFM2.5-Audio-1.5B-JP (LiquidAI) 日语端到端语音对话,1.5B轻量实时交互 gemma-4-98e-coderx-GGUF (ManniX-ITA) LCB-medium 99%,12GB 级代码专家量化包 Gemma-4-31B-it (Google) 31B 多模态模型,支持图像输入,GGUF 量化版 Gemma-4-E2B-Heretic (DuoNeural) Gemma 4 视觉模型 abliteration 版 GGUF 量化 Harness-1 (pat-jj) 20B搜索智能体,对标前沿检索性能 Gemma-4-31B-QAT-GGUF (unsloth) Gemma 4 31B 量化图文模型,支持工具调用,本地部署

2026-06-10

North-Mini-Code-1.0 (CohereLabs) 30B-A3B 代码生成与 agent 模型,面向软件工程终端任务 Gemma-4-12B-OBLITERATED (OBLITERATUS) 零拒绝消融Gemma 4,供对齐研究与红队测试

2026-06-09

Ideogram-4-NF4 (Ideogram) Ideogram 4 官方 NF4 量化,低显存本地出图

2026-06-08

ZwZ-7B (inclusionAI) 7B 视觉语言模型 GGUF 量化包,适合本地 VQA 与对话 Gemma-4-26B-A4B-QAT-GGUF (Unsloth) Gemma 4 26B MoE 量化版,用于本地图像与文本推理

2026-06-07

Gemma-4-12B-it-QAT-Q4_0 (Google) Gemma 4 12B GGUF 量化版,本地多模态推理。 ideogram-4-fp8 (ideogram-ai) 文本到图像生成模型,Ideogram 4 的 FP8 量化版本 Gemma-4-12B-it-QAT (Google) 12B开源对话模型QAT量化,可本地CPU/GPU推理 Gemma-4-26B-A4B (Google) 量化 Gemma-4,本地运行对话与指令 Qwen3.6-27B-MTPLX (Youssofal) Qwen3.6-27B 的 MLX 推理加速版供苹果芯片 Gemma-4-31B-it-QAT (Google) Google 31B QAT 对话模型,GGUF 本地部署 Gemma-4-E2B-it (Google) Gemma 4 2B 指令 GGUF,本地推理 Qwen3.5-0.8B-OptiQ-4bit (mlx-community) 苹果芯片4-bit MLX 量化 Qwen3.5-0.8B Gemma-4-E4B-it-QAT (Google) Google Gemma 4 量化版,本地消费级硬件推理 Qwen3.5-2B-OptiQ-4bit (mlx-community) 4-bit混合精度MLX量化Qwen3.5-2B,苹果芯片推理 Qwen3.6-27B-OptiQ-4bit (mlx-community) Apple Silicon的Qwen3.6-27B 4bit混合量化版 Qwen3.6-35B-A3B-OptiQ-4bit (mlx-community) Apple Silicon 4-bit MLX混精量化+MTP投机解码 gemma-4-12B-it-qat-GGUF (Unsloth) Google Gemma 4 12B QAT GGUF,本地多模态推理

2026-06-06

Higgs-Audio-v3-TTS-4B (Boson AI) 语音对话TTS:100+语种、零样克隆、情感/风格内联控制 JoyAI-Echo (JD) 分钟级多镜头音视频长视频生成,面向研究者

2026-06-05

Mellum2-12B-A2.5B-Instruct (JetBrains) 直接回答的指令模型,用于交互聊天、代码和工具调用 MisoTTS-8B (MisoLabs) 基于 Sesame CSM 的对话 TTS 模型,支持语音上下文延续 Lean Finder (delta-lab-ai) 面向数学证明的语义搜索嵌入模型,用于查找 mathlib 定理

2026-06-04

NAVA-6.3B (Baidu) 文本/图像生成音视频同步内容,支持多说话人音色控制 HelixLM-40M-ep1 (david-thrower) 循环异构图语言模型,用于个性化微调与端侧推理 Gemma-4-12B-GGUF (Unsloth) 12B 多模态模型,支持图文音频输入,本地 GGUF 量化部署 gemma-4-12B-it (Google) Google Gemma 4 12B 指令模型,GGUF 量化版本

2026-06-03

Mellum2-12B-A2.5B-Thinking (JetBrains) 思考型助手,在<think>块中输出推理链后给出最终答案 LFM2.5-8B-A1B (Liquid AI) 8.3B总参/1.5B活跃,面向端侧个人助手的混合架构模型

2026-06-02

NAVA (Baidu) 6.3B 文本生成同步音视频,支持多说话人音色控制 Cosmos3-Super-Text2Image (nvidia) 文本生成高保真图像,面向物理AI与创作

2026-06-01

Qwen3.5-9B (Qwen) Qwen3.5-9B MoQ量化版,MTP推测解码,适合本地快速生成

2026-05-31

Qwen3.6-35B-A3B-NVFP4 (NVIDIA) Qwen3.6-35B-A3B FP4量化版,面向vLLM高效推理

2026-05-29

LFM2.5-8B-A1B (LiquidAI) 混合架构边缘语言模型,GGUF 量化,供 llama.cpp 部署 LFM2.5-8B-A1B (LiquidAI) 端侧部署的混合MoE模型,用于工具调用与多语言助理 Bonsai-Image-Binary-4B (Prism ML) 1-bit量化文生图模型,专为Apple Silicon本地运行 Bonsai-Image-4B (Prism ML) 1.21GB 三元文生图扩散模型,苹果芯片本地运行 Bonsai Image Ternary 4B (Prism ML) 1.21GB三元文生图模型,4步采样,本地GPU运行

2026-05-27

BitCPM-CANN-8B (OpenBMB) 昇腾原生1.58-bit三元LLM,推理内存降6x,保持95.7%性能

2026-05-26

aro-coder-4bit (ARO-Lang) 为ARO语言微调的代码生成器,4bit量化,供ARO DSL开发者使用 FLUX.1-dev (BFL) 文本到图像生成,用于开发者与创作者的视觉内容创建 PiD (NVIDIA) 像素扩散解码器,将潜在表征一步超分至2K/4K图像 Mega-ASR (THU) 面向远场、混响、重叠语音等严重声学退化的鲁棒语音识别

2026-05-25

speaker-diarization-3.1 (pyannote) 多说话人分割模型,从音频中区分谁在何时说话

2026-05-24

Qwopus3.6-27B-v2 (Jackrong) Claude CoT 逆推微调的推理模型,支持视觉与工具调用 Qwopus3.6-27B-v2-MTP-GGUF (Jackrong) 多Token预测推理模型,面向编码、数学、DevOps开发者 Qwen3.6-27B (OBLITERATUS) 移除拒绝回路,能力保持,本地全栈部署 Lens (Microsoft) 3.8B文本生成图像基础模型,高效训练与高分辨率生成

2026-05-23

Lens-Turbo (Microsoft) 3.8B 高效文生图,4 步蒸馏,为开发者与创作者快速生成

2026-05-22

Meta-Llama-3-8B-Instruct-4bit (mlx-community) Llama-3-8B 4-bit版,M系列芯片本地推理 Ternary-Bonsai-8B (Prism ML) 三元1.58-bit量化8B模型,苹果芯片本地推理

2026-05-21

Qwopus3.5-9B-Coder-MTP (Jackrong) 9B多令牌预测代码模型,GGUF量化,面向代码推理 MiniMax-M2.7 (MiniMax) MiniMax M2.7 GGUF量化版,适合本地部署与实验 Nemotron-3-Nano-Omni-30B-A3B (NVIDIA) NVIDIA 多模态推理模型 GGUF 量化版,本地推理用 Qwen3.6-27B (Qwen) 27B参数GGUF版,本地AI原型开发 Qwen3.6-35B-A3B (Qwen) 35B MoE仅3B激活的GGUF量化版,适合本地中文开发 gemma-4-26B-A4B-it (Google) 26B总参/4B活跃的MoE指令模型,面向本地推理 Gemma-4-31B-it-GGUF (LM Studio) Google 31B 指令模型 GGUF 量化版,本地消费级硬件推理 gemma-4-E2B-it-GGUF (LM Studio) 谷歌 Gemma 4 指令模型 GGUF 量化版,本地高效部署 gemma-4-E4B-it (Google) Gemma4-4B-it 量化版, 本地轻量推理 Granite-4.1-30B (IBM) IBM Granite 30B GGUF量化, 本地部署与推理 Granite-4.1-3B-GGUF (IBM) IBM Granite 4.1 3B GGUF量化,本地推理与边缘部署 Granite-4.1-8B-GGUF (IBM) IBM Granite 4.1 8B的GGUF量化,用于本地推理 Llama-2-7b-chat-mlx (mlx-community) Apple芯片上本地运行的Llama2 7B对话模型 NuExtract3 (NuMind) 文档结构化提取和Markdown转换的4B视觉语言模型 Nemotron-Labs-Diffusion-14B (NVIDIA) 三模式 LM (AR/扩散/自推测),为 AI 应用开发者提供高效生成 Qwen3.5-9B-MTP-GGUF (unsloth) Qwen3.5-9B 多模态模型,MTP 投机解码,本地快速运行

2026-05-20

SuperGemma4-26B (Jiunsong) Gemma4 26B 无审查 MLX, 本地代理加速 LTX-2.3-Workflows (RuneXX) LTX-2.3模型的ComfyUI工作流集合,用于图像/视频生成。 XEUS (CMU WAVLab) 覆盖4000+语言的语音基础模型,供ASR/翻译微调 Whisper Large v3 MLX (mlx-community) Apple Silicon 上运行的 Whisper 语音识别模型 Whisper-large-v3-turbo (mlx-community) Mac端Whisper large-v3-turbo,MLX低延迟转写 Bonsai-8B-mlx-1bit (PrismML) Apple Silicon 的 1-bit LLM,端侧极低内存推理 Minimalism (salakash) 为开发者输出最少代码行的可运行代码 HRM-Text-1B (sapientinc) 1B预对齐前缀LM,用前缀条件做结构化输出与推理

2026-05-19

Qwen3.6-35B-A3B-GGUF (Unsloth) 支持MTP加速的3B激活参数量化视觉语言模型,面向本地编程代理

2026-05-18

Irodori-TTS-500M-v3 (Aratako) 日语TTS,表情符号控制风格,零样本克隆 Qwen3.6-27B-Heretic-Uncensored-FINETUNE-NEO-CODE-Di-IMatrix-MAX-GGUF (DavidAU) 解禁版Qwen3.6-27B量化模型,为创意写作与代码而生 Gemma-4-E4B-Aggressive (HauhauCS) 无审查的Gemma 4多模态模型,适合内容生成开发者 Gemma4-26B-A4B-Uncensored-Balanced (HauhauCS) Gemma4 无审查多模态 MoE,面向创意写作与角色扮演 Qwopus3.5-9B-Coder (Jackrong) 面向Agent编码与工具调用的9B视觉推理模型 SuperGemma4-26B-Uncensored (Jiunsong) 无审查Gemma 4 26B GGUF,适合苹果硅本地快速推理 AsymFLUX.2-klein-9B (Stanford) 像素空间文生图模型,基于AsymFlow,适合文字渲染与细节生成 jina-embeddings-v5-omni-small (Jina) 多模态嵌入模型,支持文本/图像/视频/音频 Qwen3.6-27B-GGUF (unsloth) Qwen3.6-27B GGUF量化版,面向本地部署与边缘推理 Qwen3.6-27B-MTP-GGUF (Unsloth) Qwen3.6-27B的MTP量化版,推理速度1.5-2倍提升 Qwen3.6-35B-A3B-GGUF (Unsloth) Qwen3.6 MoE GGUF 量化版,用于本地代理编程与多模态推理 LTX2.3-10Eros-GGUF (vantagewithai) LTX2.3 微调的图生视频 GGUF 模型,用于 ComfyUI

2026-05-16

Qwen3.6-40B (DavidAU) 多模态无审查推理模型,面向代码与视觉应用 Nandi-Mini-600M (FrontiersMind) 600M参数早期检查点,面向低资源多语言部署 Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive 35B MoE多模态去审查模型,适合本地无限制输出 Dramabox (ResembleAI) 通用文本转语音,面向配音与有声内容制作者 Juggernaut-Z-Image (RunDiffusion) 文本到图像扩散模型,面向 AI 应用构建者 scenema-audio (ScenemaAI) TTS 模型,面向语音合成开发者 Z-Anime (SeeSee21) 动漫风格图像生成,面向二次元AI应用开发者 Sulphur-2-base (SulphurAI) 无审查文本/图像生成视频,基于LTX2.3 Supertonic 3 (Supertone) 31种语言本地TTS,面向AI应用开发者的语音合成 Leanly_AI (jackxinning) 通用问答模型,适合知识型对话与事实查询。 OmniVoice (k2-fsa) 为开发者提供600+语言零样本语音合成 Sulphur-2-Base (vantagewithai) 图像到视频基座模型,GGUF量化版,适合本地推理