AI 情报 · 每日更新
Access · 需代理
共 225 个 (跨 61 天)
2026-07-21
GPT-OSS-20B (OpenAI)
2-bit 量化 MLX 模型,专为 Apple Silicon 推理
Nemotron-3-Embed-1B-NVFP4 (NVIDIA)
多语言文本嵌入,NVFP4 量化,专为 RAG 和检索设计
2026-07-20
gear-manual-qwen3-4b (Raindog)
面向硬件音乐设备的本地助手,基于Qwen3-4B微调
2026-07-19
Qwen3.6-27B-Fable-Fusion (DavidAU)
多阶段微调的27B视觉模型,提升推理与创意写作
Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3 (LuffyTheFox)
无审查视觉 MoE 模型,Hermes 工具调用,GGUF 本地推理
Nemotron-3-Embed-8B (NVIDIA)
多语言文本嵌入模型,面向RAG检索与语义搜索。
2026-07-18
GigaAM-Multilingual-MLX INT4 (ai-babai)
俄语及中亚语言离线语音转录,Apple Silicon 用
GigaAM-Multilingual MLX INT8 (ai-babai)
Apple Silicon 本地离线俄哈吉乌语 ASR,MLX 量化
GigaAM-Multilingual MLX (ai-babai)
Apple Silicon 上俄/哈/吉/乌语离线语音识别
GigaAM-Multilingual (ai-sage)
70+语言语音识别,关注俄语、哈萨克语等小语种
Qwen3.6-35B-A3B (andreaborio)
Qwen3.6 MoE 量化版,Apple Metal 加速推理
Nemotron-3-Embed-1B (NVIDIA)
多语言文本嵌入模型,用于语义搜索与 RAG
2026-07-17
MiniCPM5-1B-Claude-Opus-Fable5-V2-Thinking (GnLOLot)
1B 工具调用思考模型 GGUF 量化,本地运行
2026-07-16
MiniCPM5-1B-Thinking (OpenBMB)
1B 思考模型,改进编码与指令遵循,适合本地部署
Dolphin3-Cyber-8B (RavichandranJ)
网络安全领域8B微调模型, 本地离线运行红蓝队工具
UncensoredV2 (Kutches)
未审查文本生成模型,卡信息缺失
Hy-MT2-30B-A3B-APEX (Tencent)
多语言翻译 MoE 模型的 APEX 量化版,供本地 GGUF 推理
FrickFritz-4B-GGUF (fattis)
GGUF 量化,解禁角色扮演与图像描述
Bonsai-27B-mlx-1bit (Prism ML)
1-bit 27B 模型, 可在手机和笔记本本地运行推理
2026-07-15
Gemma-4-31B-Animus-V15.0-GGUF (Darkhn)
Wings of Fire 世界观角色扮演, 支持链式思维
Nemotron-3-Nano-30B-A3B (NVIDIA)
4bit MoE本地运行于Apple Silicon
Qwen3.5-35B-A3B (Qwen)
4-bit MLX 量化,Apple Silicon 本地运行文本生成
Bonsai-27B (Prism ML)
27B 1-bit 量化模型,面向笔记本与手机本地推理
Ternary-Bonsai-27B (Prism ML)
三元权重 27B 推理模型,笔记本本地运行
Ternary Bonsai 27B (prism-ml)
三元2-bit 27B开源模型,笔记本本地运行推理
2026-07-14
Qwen3.6-35B-A3B-VQ (aquaman164)
MLX VQ量化35B MoE,适合Apple Silicon本地推理
2026-07-13
Qwythos-9B-v2-GGUF (Empero AI)
修复循环的Qwen3.5推理模型GGUF,支持1M上下文与视觉
Qwythos-9B-v2 (Empero AI)
修复循环生成并保留1M上下文推理能力的研究型模型
M87 (mgwr)
Krea-2 Turbo 风格化 LoRA,电影感氛围增强
Ornith-1.0-35B-MLX (deepreinforce-ai)
Apple Silicon 上 Claude-Code 式本地编码代理
Qwen3.5-9B-OptiQ-4bit (mlx-community)
Apple Silicon 本地 4-bit 混合精度量化文本生成模型
2026-07-11
cohere-transcribe-arabic (CohereLabs)
阿拉伯语自动语音识别 (ASR) 模型
Nemotron-Labs-Audex-2B (NVIDIA)
统一音频-文本语言模型,支持语音识别、翻译、TTS 与音频生成
Krea2 Turbo Style Reference LoRA (Krea)
风格参考 LoRA,将参考图风格注入 Krea2 Turbo 生成
2026-07-10
MiniCPM5-1B-Thinking-GGUF (GnLOLot)
1B 思维链模型 GGUF 量化,本地轻量代码与指令任务
ThinkingCap-Qwen3.6-27B (bottlecapai)
视觉语言模型,思考令牌减半,GGUF量化,适合本地运行
Qwen3.6-27B-Heretic-GGUF (darkc0de)
Claude Opus推理蒸馏并反审查的27B模型GGUF版
Gepard-1.0 (nineninesix)
流式自回归 TTS,面向实时对话与语音代理
2026-07-09
Supra-Router-51M (SupraLabs)
51M 参数边缘路由器, 判断提示词复杂度并分发至本地或云端模型
Kokoro-82M (hexgrad)
82M 参数轻量 TTS 模型,支持多语言,可本地部署
NVIDIA-Nemotron-Labs-3-Puzzle-75B-A9B (NVIDIA)
面向高吞吐推理的压缩 MoE 模型,用于交互式推理与高并发部署
Nemotron-Labs-Audex-30B-A3B (NVIDIA)
音频-文本统一LLM,兼顾文本推理与语音/音频生成
2026-07-08
LTX-Best-Face-ID (Alissonerdx)
LTX-2.3 身份保持 LoRA,单参考图加提示生成人物视频
2026-07-07
Grug-12B (kai-os)
紧凑推理微调,减少冗余推理轨迹,降低推理token消耗
2026-07-06
MaralGPT-Mythos-9B (MaralGPT)
无审查 Qwen3.5-9B 微调,用于网络安全与生物医学
Krea-2 Depth ControlNet (Patil)
深度条件图像生成,保持输入图像3D结构,用于风格迁移与内容变换
Qwen3.6-35B-A3B (Qwen)
三元专家量化版,9.4 GB 全量跑在 16 GB Mac 上
paw-programs (programasweights)
用途未公开
Nova-1-Standard-1.3B (Smilyai Labs)
1.3B MoD对话模型,支持ChatML与代码/数学生成
2026-07-05
Gemma-4-12B Agentic v2 (yuxinlu1)
编程与工具调用代理微调,供开发者本地使用
2026-07-04
Sun-Direction LoRA (eric-venti-seeds)
为Flux.2 Klein 9B图像指定阳光方向,球体参考工作流
Gemma4-Gutenberg-31B-Heretic-mlx-8Bit (ailexleon)
MLX 8-bit 量化英文创意写作模型,适合故事小说生成
Laguna XS 2.1 (poolside)
33B MoE 编码模型,3B 激活,为本地代理与长任务设计
2026-07-03
Higgs TTS 3 (Boson AI)
对话式语音合成,100+语种,零样本克隆与内联控制
Ornith-1.0-35B (DeepReinforce)
35B开源编码代理模型,原生工具调用与推理链
Ornith-1.0-9B-MTP (protoLabs)
Ornith-9B MTP GGUF:llama.cpp推测解码加速
2026-07-02
Gemma4-26B-A4B (HauhauCS)
无审查Gemma4-26B MoE,适用于代理编码与创意写作
Huihui-GLM-5.2-GGUF (huihui-ai)
移除安全过滤的GLM-5.2 GGUF,供研究实验用
Huihui-Qwythos-9B-1M (huihui-ai)
未审查 1M 上下文 Qwen3.5 微调,支持工具调用
Nemotron-Labs-TwoTower-30B-A3B (NVIDIA)
双塔扩散LLM,块并行解码,2.42x生成吞吐量
Qwen3.6-27B-NVFP4 (NVIDIA)
Qwen3.6-27B NVFP4 量化,面向 vLLM 部署与推理
2026-07-01
Qwopus-3.6-35B-A3B-Coder (Jackrong)
关闭思考的编码代理模型,降低 token 延迟,适合本地工作流
LFM2.5-8B-A1B-APEX (LiquidAI / LocalAI)
8B参数1B激活MoE,消费级GPU可运行的APEX量化
Krea-2-Turbo (Krea)
12B 文本到图像扩散模型,GGUF 量化版,用于本地生成
2026-06-30
Gemma-4-12B GGUF 合集 (rahul7star)
Gemma 4 12B/3B GGUF 量化集合,供本地聊天与代码任务
Unlimited-OCR (Baidu)
3B 视觉语言 OCR 模型,文档解析与 Markdown 转换
BugTraceAI-CORE-Ultra-27B (BugTraceAI)
生成漏洞利用与安全工具,面向攻防研究者
2026-06-29
LFM2.5-230M (LiquidAI)
混合架构边缘设备模型,用于设备端文本生成
2026-06-27
Ornith-1.0-35B (DeepReinforce)
用于代理式编码的自改进开源 MoE,35B 总参、低激活,量化后本地可跑
Ornith-1.0-9B (DeepReinforce)
面向编程代理的开源文本生成模型;为单卡部署设计
Ornith-1.0-9B (DeepReinforce)
自改进编码代理模型,9B 单卡部署
2026-06-26
LFM2.5-230M (LiquidAI)
230M混合架构,为边缘设备推理与代理任务设计
Ornith-1.0-35B (DeepReinforce)
轻量级代理编码开源模型,单 GPU 可部署
Qwen3.6-27B-AEON-Uncensored (AEON-7)
无审查的27B视觉语言模型,用于多模态对话与图像理解
Qwen3.6-27B-Uncensored (AEON-7/mradermacher)
27B 无审查多模态混合模型,本地创作者使用
Gemma-4-31B-it (Google)
IQ2_M 31B 多模态 Agent,10 GiB 本地运行
Mythos-nano (squ11z1)
3B无审查推理模型,专注数学与竞赛编程
2026-06-25
Krea2-FP8 (KREA)
Krea 2 Turbo 的 FP8 量化版,16GB 显存可用
Mythos-nano (squ11z1)
轻量推理模型,专注数学与代码任务的本地运行
2026-06-24
Gemma4-12B-Uncensored (HauhauCS)
解除审查的Gemma4多模态模型,面向代理编码与创意写作
Qwopus3.6-27B-Coder (Jackrong)
27B编码器GGUF,兼容多种工具历史格式,供本地开发者使用
Qwen3.6-27b-Fable5 (hotdogs)
Qwen3.6-27B的LoRA微调,用于故事与寓言生成
Krea-2-Raw (Krea)
12B 图像生成基座,用于 LoRA 微调训练
Krea-2-Turbo (Krea)
12B 扩散 Transformer 文生图模型,面向创作者与开发者
2026-06-23
Qwable-3.6-35b (Mia-AiLab)
Qwen3.6-35b 全量微调,强化结构化推理与代码助手
Qwythos-9B (Empero)
开源 9B 推理模型,不审查,支持 1M 上下文和函数调用
Huihui-gemma-4-12B-coder-abliterated (huihui-ai)
未审查版 Gemma 代码模型,用于编程与推理,已去除拒答
FastContext-1.0-4B-RL (Microsoft)
为编码代理提供仓库探索与精确文件引用
2026-06-22
Qwythos-9B-Claude-Mythos-5-1M (Empero)
基于Qwen3.5的推理模型,1M上下文,支持函数调用
ideogram_4_turbotime_lora (ostris)
Ideogram 4 加速 LoRA,2 步出图,无需 CFG
GLM-5.2-GGUF (Unsloth)
1M上下文开源模型,面向长文本处理与代码生成
2026-06-20
SIQ-1-35B (AlexWortega)
3B活跃参数的通用Agent,自动研究/编程/推理
Inflect-Nano-v1 (owensong)
超小型英文TTS,总4.63M参数,适合本地/嵌入式实验
Laguna M.1
云端旗舰,225B 参数稀疏 MoE,专为智能体编程和长周期任务设计
Gemma-4-12B-it-LWQ6 (wepiqx)
混合量化Gemma-4-12B,8GB显存Pascal GPU代码生成
gemma-4-12B-agentic-v2 (yuxinlu1)
本地离线编码与工具使用Agent,仅需4.5GB显存即可运行
2026-06-19
LFM2.5-ColBERT-350M (LiquidAI)
11 语言 ColBERT 检索模型,专为短文本 RAG 设计
LFM2.5-Embedding-350M (LiquidAI)
11语种双编码器,面向端侧语义检索
2026-06-18
Gemma-4-31B-StyleTune (Gryphe)
Gemma 4 31B风格微调,陈词减60%,角色扮演与创意写作。
Qwopus-3.6-27B-Coder (Jackrong)
面向代理编码与工具调用的27B推理模型
Qwen3.6-27B-MTP-pi-tune (bytkim)
面向无思考代理编码的MTP微调版,本地GGUF推理
2026-06-17
Qwable-27B (Mia-AiLab)
基于 Qwen3.6 的推理与代码微调模型,面向本地部署与结构化助手
Qwable-v1 (lordx64)
Qwen3.6基MoE代理编码模型(3B激活)
2026-06-16
PP-OCRv6_medium_det (PaddlePaddle)
轻量级多语言文本检测模型,48语种,服务端/边缘可用
FastContext-1.0-4B-SFT (Microsoft)
轻量仓库探索子代理,供编码代理按需调用,减少 token 消耗
prism-coder-14b (dcostenco)
基于 Qwen3 的 14B 代码模型 GGUF 量化,本地可跑
prism-coder-14b (mradermacher)
基于 Qwen3 的代码模型,GGUF 量化版,适合本地运行
2026-06-15
Z-Image-Engineer-V6 (BennyDaBall)
4B 提示词增强与 Z-Image 文本编码器,本地双用途
DiffusionGemma-26B-A4B-it-NVFP4 (NVIDIA)
扩散多模态文本生成,3.8B活跃参数,NVFP4量化
2026-06-14
niko_orchestrator_gguf (SAi404)
Llama-3.2-3B 微调,GGUF 格式,给本地推理用户
ZONOS2 (Zyphra)
基于 MoE 的多语言 TTS,支持零样本克隆与流式生成
Averroes-Q-Instruct (hayulalab)
Qwen2 架构的阿/英指令模型 GGUF 量化
Gemma4-12B-Coder (yuxinlu1)
本地 Python 编程模型,离线解决算法问题
North-Mini-Code-1.0 (Cohere)
30B总/3B激活的MoE代码代理模型,专注代码生成与终端任务
2026-06-13
Qwopus3.6-27B-Coder (Jackrong)
27B编码与工具调用推理模型 (GGUF)
Quasar-Preview (silx-ai)
18B MoE预览模型,面向Bittensor SN24研究蒸馏
DiffusionGemma-26B-A4B-it (Google)
离散扩散文本生成,支持图像/视频输入,低延迟
2026-06-12
LFM2.5-1.2B-JP (LiquidAI)
日英双语聊天模型,适合代理工作流与工具使用
Delphi-25B (Marin Community)
Delphi扩展律研究基座,25B参数,终版模型
2026-06-11
LFM2.5-Audio-1.5B-JP (LiquidAI)
日语端到端语音对话,1.5B轻量实时交互
gemma-4-98e-coderx-GGUF (ManniX-ITA)
LCB-medium 99%,12GB 级代码专家量化包
Gemma-4-31B-it (Google)
31B 多模态模型,支持图像输入,GGUF 量化版
Gemma-4-E2B-Heretic (DuoNeural)
Gemma 4 视觉模型 abliteration 版 GGUF 量化
Harness-1 (pat-jj)
20B搜索智能体,对标前沿检索性能
Gemma-4-31B-QAT-GGUF (unsloth)
Gemma 4 31B 量化图文模型,支持工具调用,本地部署
2026-06-10
North-Mini-Code-1.0 (CohereLabs)
30B-A3B 代码生成与 agent 模型,面向软件工程终端任务
Gemma-4-12B-OBLITERATED (OBLITERATUS)
零拒绝消融Gemma 4,供对齐研究与红队测试
2026-06-09
Ideogram-4-NF4 (Ideogram)
Ideogram 4 官方 NF4 量化,低显存本地出图
2026-06-08
ZwZ-7B (inclusionAI)
7B 视觉语言模型 GGUF 量化包,适合本地 VQA 与对话
Gemma-4-26B-A4B-QAT-GGUF (Unsloth)
Gemma 4 26B MoE 量化版,用于本地图像与文本推理
2026-06-07
Gemma-4-12B-it-QAT-Q4_0 (Google)
Gemma 4 12B GGUF 量化版,本地多模态推理。
ideogram-4-fp8 (ideogram-ai)
文本到图像生成模型,Ideogram 4 的 FP8 量化版本
Gemma-4-12B-it-QAT (Google)
12B开源对话模型QAT量化,可本地CPU/GPU推理
Gemma-4-26B-A4B (Google)
量化 Gemma-4,本地运行对话与指令
Qwen3.6-27B-MTPLX (Youssofal)
Qwen3.6-27B 的 MLX 推理加速版供苹果芯片
Gemma-4-31B-it-QAT (Google)
Google 31B QAT 对话模型,GGUF 本地部署
Gemma-4-E2B-it (Google)
Gemma 4 2B 指令 GGUF,本地推理
Qwen3.5-0.8B-OptiQ-4bit (mlx-community)
苹果芯片4-bit MLX 量化 Qwen3.5-0.8B
Gemma-4-E4B-it-QAT (Google)
Google Gemma 4 量化版,本地消费级硬件推理
Qwen3.5-2B-OptiQ-4bit (mlx-community)
4-bit混合精度MLX量化Qwen3.5-2B,苹果芯片推理
Qwen3.6-27B-OptiQ-4bit (mlx-community)
Apple Silicon的Qwen3.6-27B 4bit混合量化版
Qwen3.6-35B-A3B-OptiQ-4bit (mlx-community)
Apple Silicon 4-bit MLX混精量化+MTP投机解码
gemma-4-12B-it-qat-GGUF (Unsloth)
Google Gemma 4 12B QAT GGUF,本地多模态推理
2026-06-06
Higgs-Audio-v3-TTS-4B (Boson AI)
语音对话TTS:100+语种、零样克隆、情感/风格内联控制
JoyAI-Echo (JD)
分钟级多镜头音视频长视频生成,面向研究者
2026-06-05
Mellum2-12B-A2.5B-Instruct (JetBrains)
直接回答的指令模型,用于交互聊天、代码和工具调用
MisoTTS-8B (MisoLabs)
基于 Sesame CSM 的对话 TTS 模型,支持语音上下文延续
Lean Finder (delta-lab-ai)
面向数学证明的语义搜索嵌入模型,用于查找 mathlib 定理
2026-06-04
NAVA-6.3B (Baidu)
文本/图像生成音视频同步内容,支持多说话人音色控制
HelixLM-40M-ep1 (david-thrower)
循环异构图语言模型,用于个性化微调与端侧推理
Gemma-4-12B-GGUF (Unsloth)
12B 多模态模型,支持图文音频输入,本地 GGUF 量化部署
gemma-4-12B-it (Google)
Google Gemma 4 12B 指令模型,GGUF 量化版本
2026-06-03
Mellum2-12B-A2.5B-Thinking (JetBrains)
思考型助手,在<think>块中输出推理链后给出最终答案
LFM2.5-8B-A1B (Liquid AI)
8.3B总参/1.5B活跃,面向端侧个人助手的混合架构模型
2026-06-02
NAVA (Baidu)
6.3B 文本生成同步音视频,支持多说话人音色控制
Cosmos3-Super-Text2Image (nvidia)
文本生成高保真图像,面向物理AI与创作
2026-06-01
Qwen3.5-9B (Qwen)
Qwen3.5-9B MoQ量化版,MTP推测解码,适合本地快速生成
2026-05-31
Qwen3.6-35B-A3B-NVFP4 (NVIDIA)
Qwen3.6-35B-A3B FP4量化版,面向vLLM高效推理
2026-05-29
LFM2.5-8B-A1B (LiquidAI)
混合架构边缘语言模型,GGUF 量化,供 llama.cpp 部署
LFM2.5-8B-A1B (LiquidAI)
端侧部署的混合MoE模型,用于工具调用与多语言助理
Bonsai-Image-Binary-4B (Prism ML)
1-bit量化文生图模型,专为Apple Silicon本地运行
Bonsai-Image-4B (Prism ML)
1.21GB 三元文生图扩散模型,苹果芯片本地运行
Bonsai Image Ternary 4B (Prism ML)
1.21GB三元文生图模型,4步采样,本地GPU运行
2026-05-27
BitCPM-CANN-8B (OpenBMB)
昇腾原生1.58-bit三元LLM,推理内存降6x,保持95.7%性能
2026-05-26
aro-coder-4bit (ARO-Lang)
为ARO语言微调的代码生成器,4bit量化,供ARO DSL开发者使用
FLUX.1-dev (BFL)
文本到图像生成,用于开发者与创作者的视觉内容创建
PiD (NVIDIA)
像素扩散解码器,将潜在表征一步超分至2K/4K图像
Mega-ASR (THU)
面向远场、混响、重叠语音等严重声学退化的鲁棒语音识别
2026-05-25
speaker-diarization-3.1 (pyannote)
多说话人分割模型,从音频中区分谁在何时说话
2026-05-24
Qwopus3.6-27B-v2 (Jackrong)
Claude CoT 逆推微调的推理模型,支持视觉与工具调用
Qwopus3.6-27B-v2-MTP-GGUF (Jackrong)
多Token预测推理模型,面向编码、数学、DevOps开发者
Qwen3.6-27B (OBLITERATUS)
移除拒绝回路,能力保持,本地全栈部署
Lens (Microsoft)
3.8B文本生成图像基础模型,高效训练与高分辨率生成
2026-05-23
Lens-Turbo (Microsoft)
3.8B 高效文生图,4 步蒸馏,为开发者与创作者快速生成
2026-05-22
Meta-Llama-3-8B-Instruct-4bit (mlx-community)
Llama-3-8B 4-bit版,M系列芯片本地推理
Ternary-Bonsai-8B (Prism ML)
三元1.58-bit量化8B模型,苹果芯片本地推理
2026-05-21
Qwopus3.5-9B-Coder-MTP (Jackrong)
9B多令牌预测代码模型,GGUF量化,面向代码推理
MiniMax-M2.7 (MiniMax)
MiniMax M2.7 GGUF量化版,适合本地部署与实验
Nemotron-3-Nano-Omni-30B-A3B (NVIDIA)
NVIDIA 多模态推理模型 GGUF 量化版,本地推理用
Qwen3.6-27B (Qwen)
27B参数GGUF版,本地AI原型开发
Qwen3.6-35B-A3B (Qwen)
35B MoE仅3B激活的GGUF量化版,适合本地中文开发
gemma-4-26B-A4B-it (Google)
26B总参/4B活跃的MoE指令模型,面向本地推理
Gemma-4-31B-it-GGUF (LM Studio)
Google 31B 指令模型 GGUF 量化版,本地消费级硬件推理
gemma-4-E2B-it-GGUF (LM Studio)
谷歌 Gemma 4 指令模型 GGUF 量化版,本地高效部署
gemma-4-E4B-it (Google)
Gemma4-4B-it 量化版, 本地轻量推理
Granite-4.1-30B (IBM)
IBM Granite 30B GGUF量化, 本地部署与推理
Granite-4.1-3B-GGUF (IBM)
IBM Granite 4.1 3B GGUF量化,本地推理与边缘部署
Granite-4.1-8B-GGUF (IBM)
IBM Granite 4.1 8B的GGUF量化,用于本地推理
Llama-2-7b-chat-mlx (mlx-community)
Apple芯片上本地运行的Llama2 7B对话模型
NuExtract3 (NuMind)
文档结构化提取和Markdown转换的4B视觉语言模型
Nemotron-Labs-Diffusion-14B (NVIDIA)
三模式 LM (AR/扩散/自推测),为 AI 应用开发者提供高效生成
Qwen3.5-9B-MTP-GGUF (unsloth)
Qwen3.5-9B 多模态模型,MTP 投机解码,本地快速运行
2026-05-20
SuperGemma4-26B (Jiunsong)
Gemma4 26B 无审查 MLX, 本地代理加速
LTX-2.3-Workflows (RuneXX)
LTX-2.3模型的ComfyUI工作流集合,用于图像/视频生成。
XEUS (CMU WAVLab)
覆盖4000+语言的语音基础模型,供ASR/翻译微调
Whisper Large v3 MLX (mlx-community)
Apple Silicon 上运行的 Whisper 语音识别模型
Whisper-large-v3-turbo (mlx-community)
Mac端Whisper large-v3-turbo,MLX低延迟转写
Bonsai-8B-mlx-1bit (PrismML)
Apple Silicon 的 1-bit LLM,端侧极低内存推理
Minimalism (salakash)
为开发者输出最少代码行的可运行代码
HRM-Text-1B (sapientinc)
1B预对齐前缀LM,用前缀条件做结构化输出与推理
2026-05-19
Qwen3.6-35B-A3B-GGUF (Unsloth)
支持MTP加速的3B激活参数量化视觉语言模型,面向本地编程代理
2026-05-18
Irodori-TTS-500M-v3 (Aratako)
日语TTS,表情符号控制风格,零样本克隆
Qwen3.6-27B-Heretic-Uncensored-FINETUNE-NEO-CODE-Di-IMatrix-MAX-GGUF (DavidAU)
解禁版Qwen3.6-27B量化模型,为创意写作与代码而生
Gemma-4-E4B-Aggressive (HauhauCS)
无审查的Gemma 4多模态模型,适合内容生成开发者
Gemma4-26B-A4B-Uncensored-Balanced (HauhauCS)
Gemma4 无审查多模态 MoE,面向创意写作与角色扮演
Qwopus3.5-9B-Coder (Jackrong)
面向Agent编码与工具调用的9B视觉推理模型
SuperGemma4-26B-Uncensored (Jiunsong)
无审查Gemma 4 26B GGUF,适合苹果硅本地快速推理
AsymFLUX.2-klein-9B (Stanford)
像素空间文生图模型,基于AsymFlow,适合文字渲染与细节生成
jina-embeddings-v5-omni-small (Jina)
多模态嵌入模型,支持文本/图像/视频/音频
Qwen3.6-27B-GGUF (unsloth)
Qwen3.6-27B GGUF量化版,面向本地部署与边缘推理
Qwen3.6-27B-MTP-GGUF (Unsloth)
Qwen3.6-27B的MTP量化版,推理速度1.5-2倍提升
Qwen3.6-35B-A3B-GGUF (Unsloth)
Qwen3.6 MoE GGUF 量化版,用于本地代理编程与多模态推理
LTX2.3-10Eros-GGUF (vantagewithai)
LTX2.3 微调的图生视频 GGUF 模型,用于 ComfyUI
2026-05-16
Qwen3.6-40B (DavidAU)
多模态无审查推理模型,面向代码与视觉应用
Nandi-Mini-600M (FrontiersMind)
600M参数早期检查点,面向低资源多语言部署
Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive
35B MoE多模态去审查模型,适合本地无限制输出
Dramabox (ResembleAI)
通用文本转语音,面向配音与有声内容制作者
Juggernaut-Z-Image (RunDiffusion)
文本到图像扩散模型,面向 AI 应用构建者
scenema-audio (ScenemaAI)
TTS 模型,面向语音合成开发者
Z-Anime (SeeSee21)
动漫风格图像生成,面向二次元AI应用开发者
Sulphur-2-base (SulphurAI)
无审查文本/图像生成视频,基于LTX2.3
Supertonic 3 (Supertone)
31种语言本地TTS,面向AI应用开发者的语音合成
Leanly_AI (jackxinning)
通用问答模型,适合知识型对话与事实查询。
OmniVoice (k2-fsa)
为开发者提供600+语言零样本语音合成
Sulphur-2-Base (vantagewithai)
图像到视频基座模型,GGUF量化版,适合本地推理
Esc
输入关键词,跨模型 / 数据集 / 空间 / 工具 / 资讯 / 论文 检索