模型

开源模型选型

来自 HuggingFace · 值得本地跑的开源模型 · 共 381 个

按任务、硬件和许可筛选候选;命令与次要规格在卡片里按需展开。

筛选

显存档为包含式(更低显存也能跑的模型一并计入,按结构化 footprint 估算;暂无估算的模型不进任何显存档);「MLX 权重」只数仓库里确有 MLX 权重形态的模型,不等于全部可在 Apple Silicon 上运行的模型;任务内多选取并集,不同行之间取交集,再与搜索取交集。

共 381 个模型

    • 9B 多模态 GGUF 量化,视觉+文本,给本地量化部署者

      参数量
      9B
      商用
      可商用

      当前运行配置 mradermacher/Ornith-1.5-9B-uncensored-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf mradermacher/Ornith-1.5-9B-uncensored-GGUF
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      国内可达
      需代理
    • Logicer 模型 GGUF 量化文件,面向本地推理用户

      商用
      需自查

      当前运行配置 batuhan-elibuyuk/logicer-ggufs-public

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf batuhan-elibuyuk/logicer-ggufs-public
      为何暂无估算
      缺少可用的参数量依据,无法估算显存
      国内可达
      需代理
    • 27B图像文本微调GGUF,面向本地硬件推理

      参数量
      27B
      商用
      可商用

      当前运行配置 DavidAU/Qwen3.8-27B-TWIN-TURBO-Fable-Cold-Fusion-709-L-Uncensored-NM-DAU-NEO-MTP-GGUF

      显存
      ~57GB BF16(估算)
      查看详情
      查看运行方式
      llama-server -hf DavidAU/Qwen3.8-27B-TWIN-TURBO-Fable-Cold-Fusion-709-L-Uncensored-NM-DAU-NEO-MTP-GGUF
      许可证
      Apache-2.0
      上下文
      256k
      国内可达
      需代理
    • Qwen3.8-27B 低思考 token GGUF,支持图像输入

      参数量
      27B
      商用
      需自查

      当前运行配置 ukisai/Swift-Qwen3.8-27B-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf ukisai/Swift-Qwen3.8-27B-GGUF:Q4_K_M --jinja -fa on -ngl 99 -c 262144 --temp 1.0 --top-p 0.95 --top-k 20 --min-p 0 --presence-penalty 0 --repeat-penalty 1.0
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Swift Open License v1.0 (gated)
      上下文
      262k
      国内可达
      需代理
    • LTX-2.5 FP8视频模型,合并多个LoRA,支持文/图生视频

      商用
      需自查

      当前运行配置 ChrisColeTech/LTX-2.5-uncensored-v1.1-FP8

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      缺少可用的显存依据
      国内可达
      需代理
    • Qwen3-4B-Base-DAPO-v4 文本生成模型

      参数量
      4B
      商用
      可商用

      当前运行配置 ReliquaryForge/qwen3-4b-base-dapo-v4

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve ReliquaryForge/qwen3-4b-base-dapo-v4
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      32k
      国内可达
      需代理
    • 生成式 UI 扩散模型,面向 OpenUI 应用开发者

      参数量
      26B (4B active)
      商用
      需自查

      当前运行配置 thesysdev/OUI-1

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve thesysdev/OUI-1 --trust-remote-code --max-model-len 16384 --served-model-name OUI-1 --enable-auto-tool-choice --tool-call-parser gemma4
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache 2.0
      上下文
      16k
      国内可达
      需代理
    • 面向 Atlassian Forge 的 6-bit MLX 模型

      参数量
      9B
      商用
      可商用

      当前运行配置 Mihai-LeanZero/Qwen3.5-9B-Atlassian-Q4-mlx

      显存
      ~5.4GB 4-bit(估算)
      查看详情
      查看运行方式
      mlx_lm.generate --model Mihai-LeanZero/Qwen3.5-9B-Atlassian-Q4-mlx --prompt "Which Forge module adds a panel to the Jira issue view?"
      许可证
      Apache-2.0
      上下文
      32k
      国内可达
      需代理
      其它形态
      MLX·mihai-leanzero · MLX·mihai-leanzero
    • Atlassian 开发专用 27B MLX 模型

      参数量
      27B
      商用
      可商用

      当前运行配置 Mihai-LeanZero/Qwen3.8-27B-Atlassian-Q8-mlx

      显存
      ~30GB 8-bit(估算)
      查看详情
      查看运行方式
      mlx_lm.generate --model Mihai-LeanZero/Qwen3.8-27B-Atlassian-Q8-mlx
      许可证
      Apache-2.0
      上下文
      128k
      国内可达
      需代理
      其它形态
      MLX·mihai-leanzero · MLX·mihai-leanzero
    • 开源语音生成与编辑基础模型,支持零样本 TTS

      参数量
      1.5B
      商用
      可商用

      当前运行配置 tencent/AuK

      显存
      暂无估算
      查看详情
      查看运行方式
      python -m sglang_omni.cli serve --model-path tencent/AuK
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MIT
      语言
      未公开
      国内可达
      魔搭可用
    • 35B 稀疏 MoE,3 GiB 内存可跑,面向设备端推理

      参数量
      35B (3B 激活)
      商用
      可商用

      当前运行配置 Edge0/Edge0-35B-A3B-preview

      显存
      ~21GB 4-bit(估算)
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      许可证
      Apache-2.0
      国内可达
      需代理
    • Q4_K_XL 量化分层权重,供本地调试

      商用
      需自查

      当前运行配置 meshllm/Kimi-K3-UD-Q4_K_XL-layers

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      缺少可用的参数量依据,无法估算显存
      国内可达
      需代理
    • 面向 agent 开发者的 4B 文本工具调用模型

      参数量
      4B
      商用
      可商用

      当前运行配置 TokenRhythm/NeoHorse-1-4B

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve TokenRhythm/NeoHorse-1-4B --reasoning-parser qwen3 --enable-auto-tool-choice --tool-call-parser qwen3_coder
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      262k (可扩至 1.01M)
      国内可达
      魔搭可用
    • 6B文生图与编辑模型,含4步Turbo版

      参数量
      6B
      商用
      可商用

      当前运行配置 inclusionAI/LLaDA-Image

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      国内可达
      魔搭可用
    • 任务与用途未知,无模型卡说明

      商用
      需自查

      当前运行配置 dasLOL/mt-support-3g-v2

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      缺少可用的参数量依据,无法估算显存
      国内可达
      需代理
    • 2B 端侧文本模型,面向本地助手与 agent

      参数量
      2B
      商用
      可商用

      当前运行配置 openbmb/MiniCPM5-2B

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf openbmb/MiniCPM5-2B-GGUF
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      131k
      国内可达
      魔搭可用
      其它形态
      原生 · GGUF
    • 长时程agent模型,面向电脑操作与网页浏览

      商用
      可商用

      当前运行配置 nex-agi/Nex-N2.5-Pro

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      缺少可用的参数量依据,无法估算显存
      许可证
      apache-2.0
      国内可达
      魔搭可用
    • 开源 agent 模型,面向长程电脑操作与网页任务

      参数量
      35.1B
      商用
      可商用

      当前运行配置 nex-agi/Nex-N2.5-mini

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      国内可达
      魔搭可用
    • Apple 芯片 13.8GiB VQ 量化,24GB 可跑

      参数量
      35B-A3B
      商用
      可商用

      当前运行配置 TheDrainFlorist/Qwen3.6-35B-A3B-VQ-3.4bpw

      显存
      暂无估算
      查看详情
      查看运行方式
      python -m mlx_lm generate --model TheDrainFlorist/Qwen3.6-35B-A3B-VQ-3.4bpw --prompt 'Explain the difference between a mutex and a semaphore.' --max-tokens 512
      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
    • 4B 通用文本模型 GGUF,可本地跑对话、编码与 agent

      参数量
      4B
      商用
      可商用

      当前运行配置 XHToken/Spark-X2.5-4B

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve XHToken/Spark-X2.5-4B --trust-remote-code
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      1M
      国内可达
      需代理
      其它形态
      原生 · GGUF
    • DeepSeek-V4 视觉实验 GGUF,本地跑多模态 agent

      商用
      可商用

      当前运行配置 unsloth/DeepSeek-V4-Flash-Vision-Exp-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf unsloth/DeepSeek-V4-Flash-Vision-Exp-GGUF
      为何暂无估算
      缺少可用的参数量依据,无法估算显存
      许可证
      MIT
      国内可达
      需代理
    • Apple Silicon VQ量化 Qwen3.6-35B-A3B

      参数量
      35B-A3B
      商用
      可商用

      当前运行配置 TheDrainFlorist/Qwen3.6-35B-A3B-VQ-3.8bpw

      显存
      暂无估算
      查看详情
      查看运行方式
      python -m mlx_lm generate --model TheDrainFlorist/Qwen3.6-35B-A3B-VQ-3.8bpw
      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      Apache-2.0
      国内可达
      需代理
    • Mac 可跑的 Qwen3.6-35B VQ 量化

      参数量
      35B-A3B
      商用
      可商用

      当前运行配置 TheDrainFlorist/Qwen3.6-35B-A3B-VQ-4.6bpw

      显存
      暂无估算
      查看详情
      查看运行方式
      python -m mlx_lm generate --model TheDrainFlorist/Qwen3.6-35B-A3B-VQ-4.6bpw --prompt "Hello"
      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
    • MLX 向量量化,Apple Silicon 本地推理

      参数量
      35B-A3B
      商用
      可商用

      当前运行配置 TheDrainFlorist/Qwen3.6-35B-A3B-VQ-5.4bpw

      显存
      暂无估算
      查看详情
      查看运行方式
      python -m mlx_lm generate --model TheDrainFlorist/Qwen3.6-35B-A3B-VQ-5.4bpw --prompt "Hello" --max-tokens 32
      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      Apache-2.0
      国内可达
      需代理
    • 流式说话人归属语音转写,支持10语言与热词

      参数量
      7B
      商用
      可商用

      当前运行配置 microsoft/VibeVoice-ASR-Streaming-7B

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MIT
      国内可达
      需代理
    • 7B 密集解码器,512K 上下文,面向推理/代码/长上下文

      参数量
      7B
      商用
      可商用

      当前运行配置 IFM/K2-Horizon-7B

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve IFM/K2-Horizon-7B --trust-remote-code --dtype bfloat16 --max-model-len 131072 --reasoning-parser k2_horizon --enable-auto-tool-choice --tool-call-parser k2_horizon
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      512k
      国内可达
      需代理
    • 36B/4B 激活 MoE+MoVA,面向 agent 与长上下文

      参数量
      36B (4B 激活)
      商用
      可商用

      当前运行配置 IFM/K2-Horizon-MoVA-36B-A4B

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve IFM/K2-Horizon-MoVA-36B-A4B --trust-remote-code --reasoning-parser k2_horizon --tool-call-parser k2_horizon --enable-auto-tool-choice
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      512k
      国内可达
      需代理
      其它形态
      原生 · GGUF
    • Apple Silicon 用 Qwen3.8-27B 量化版

      参数量
      27B
      商用
      可商用

      当前运行配置 TheDrainFlorist/Qwen3.8-27B-VQ-3.9bpw

      显存
      暂无估算
      查看详情
      查看运行方式
      python -m mlx_lm generate --model TheDrainFlorist/Qwen3.8-27B-VQ-3.9bpw --prompt "Explain vector quantization briefly." --max-tokens 512
      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      Apache-2.0
      国内可达
      需代理
    • Qwen3.8-27B MLX 向量量化版

      参数量
      27B
      商用
      可商用

      当前运行配置 TheDrainFlorist/Qwen3.8-27B-VQ-4.5bpw

      显存
      暂无估算
      查看详情
      查看运行方式
      python -m mlx_lm generate --model TheDrainFlorist/Qwen3.8-27B-VQ-4.5bpw --prompt "Explain vector quantization briefly." --max-tokens 512
      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
    • Apple Silicon 本地运行的 27B 向量量化文本生成模型

      参数量
      27B
      商用
      可商用

      当前运行配置 TheDrainFlorist/Qwen3.8-27B-VQ-4.8bpw

      显存
      暂无估算
      查看详情
      查看运行方式
      python -m mlx_lm generate --model TheDrainFlorist/Qwen3.8-27B-VQ-4.8bpw --prompt "Explain vector quantization briefly." --max-tokens 512
      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      Apache-2.0
      国内可达
      需代理
    • 腾讯 Hy4 量化版,需补丁构建 llama.cpp

      商用
      需自查

      当前运行配置 AngelSlim/Hy4-preview-GGUF

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      缺少可用的参数量依据,无法估算显存
      国内可达
      需代理
    • Qwen3.8-27B 微调 GGUF,面向本地 agent 工作流

      参数量
      27B
      商用
      可商用

      当前运行配置 Jackrong/Qwopus3.8-27B-Flash-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf Jackrong/Qwopus3.8-27B-Flash-GGUF
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
    • 1.7B 通用语言模型,支持 1M 上下文与工具调用

      参数量
      1.7B
      商用
      可商用

      当前运行配置 XHToken/Spark-X2.5-1.7B

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve XHToken/Spark-X2.5-1.7B --trust-remote-code
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      1M
      国内可达
      需代理
    • 社区版说话人分离,用于会议/访谈音频

      商用
      需自查

      当前运行配置 pyannote/speaker-diarization-community-1

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      缺少可用的显存依据
      国内可达
      需代理
    • 开源 MoE 代码与智能体模型 GGUF 量化版

      商用
      需自查

      当前运行配置 unsloth/GLM-5.3-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      ollama run hf.co/unsloth/GLM-5.3-GGUF

      其它 1 种运行方式见详情页

      为何暂无估算
      缺少可用的参数量依据,无法估算显存
      许可证
      GLM-5.3 自定义许可证
      上下文
      1M
      国内可达
      需代理
    • 英文因果语言模型,用于文本生成与下游微调

      参数量
      124M
      商用
      可商用

      当前运行配置 openai-community/gpt2

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve openai-community/gpt2
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MIT
      上下文
      1024
      国内可达
      需代理
    • Granite 4.2 3B MLX 6bit 量化,本地推理

      参数量
      3B
      商用
      可商用

      当前运行配置 lmstudio-community/granite-4.2-3b-MLX-6bit

      显存
      暂无估算
      查看详情
      查看运行方式
      mlx_lm.generate --model lmstudio-community/granite-4.2-3b-MLX-6bit
      为何暂无估算
      已有格式线索,但估算映射未支持,无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
    • GSQ-RCO 非均匀 GGUF 量化,含视觉投影器

      参数量
      27B
      商用
      可商用

      当前运行配置 ISTA-DASLab/Qwen3.8-27B-GSQ-RCO-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      ollama run hf.co/ISTA-DASLab/Qwen3.8-27B-GSQ-RCO-GGUF
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
    • Mac本地Qwen3.8-27B-4bit量化

      参数量
      27B
      商用
      可商用

      当前运行配置 Youssofal/Qwen3.8-27B-MTPLX-Bare-Speed

      显存
      ~16GB 4-bit(估算)
      查看详情
      查看运行方式
      mlx_lm.generate --model Youssofal/Qwen3.8-27B-MTPLX-Bare-Speed
      许可证
      Apache-2.0
      上下文
      262k
      国内可达
      需代理
    • Mac 上 8-bit 量化 Qwen3.8 27B(MTP 加速)

      参数量
      27B
      商用
      可商用

      当前运行配置 Youssofal/Qwen3.8-27B-MTPLX-Optimized-Quality

      显存
      ~30GB 8-bit(估算)
      查看详情
      查看运行方式
      mtplx serve --model Youssofal/Qwen3.8-27B-MTPLX-Optimized-Quality
      许可证
      Apache-2.0
      上下文
      262k
      国内可达
      需代理
    • 图像文本多模态 GGUF,面向本地消费级硬件部署

      参数量
      27B
      商用
      可商用

      当前运行配置 DavidAU/Qwen3.8-27B-TURBO-Fable-Cold-Fusion-735-882-Heretic-Uncensored-NEO-CODER-MAX-MTP-GGUF

      显存
      ~57GB BF16(估算)
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      许可证
      apache-2.0
      上下文
      256k
      国内可达
      需代理
    • 混合注意力视频生成:14.4s片段11.23s

      商用
      需自查

      当前运行配置 OpenVDN/vdn-minimax-h3

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      缺少可用的显存依据
      许可证
      MiniMax H3 Community License Agreement(排除 EU/UK/KR/US)
      国内可达
      需代理
    • 英文句子/短段落向量化,用于语义搜索与聚类

      参数量
      22.7M
      商用
      可商用

      当前运行配置 sentence-transformers/all-MiniLM-L6-v2

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      256 word pieces
      国内可达
      需代理
    • Mac 上 MTPLX 4-bit 量化,MTP 投机加速

      参数量
      125B-A6B
      商用
      需自查

      当前运行配置 Youssofal/Qwen3.8-Flash-Next-MTPLX-Optimized-Speed

      显存
      ~75GB 4-bit(估算)
      查看详情
      查看运行方式
      mtplx serve --model Youssofal/Qwen3.8-Flash-Next-MTPLX-Optimized-Speed
      许可证
      qwen-community-1.0
      上下文
      262k
      国内可达
      需代理
    • Granite 4.2 8B 的 MLX 6-bit 量化

      参数量
      8B
      商用
      可商用

      当前运行配置 lmstudio-community/granite-4.2-8b-MLX-6bit

      显存
      暂无估算
      查看详情
      查看运行方式
      mlx_lm.generate --model lmstudio-community/granite-4.2-8b-MLX-6bit
      为何暂无估算
      已有格式线索,但估算映射未支持,无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
    • 文本生成同步音视频,4步推理

      参数量
      35B
      商用
      需自查

      当前运行配置 FastVideo/FastVideo-FastH3-4-step-Preview-v1-VSA-DataFree

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MiniMax H3 Community License
      国内可达
      需代理
    • 为 GLM-5.3-Flash 推理加速的 DFlash2 草稿模型

      参数量
      1.2B
      商用
      不可商用

      当前运行配置 incoai/GLM-5.3-Flash-DFlash2

      显存
      暂无估算
      查看详情
      查看运行方式
      sglang serve --model-path zai-org/GLM-5.3-Flash --trust-remote-code --speculative-algorithm DFLASH --speculative-draft-model-path incoai/GLM-5.3-Flash-DFlash2 --speculative-draft-attention-backend fa4
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      CC BY-NC-ND 4.0
      国内可达
      需代理
    • IBM 30B MLX 6bit 量化,Mac 用

      参数量
      30B
      商用
      可商用

      当前运行配置 lmstudio-community/granite-4.2-30b-MLX-6bit

      显存
      暂无估算
      查看详情
      查看运行方式
      mlx_lm.generate --model lmstudio-community/granite-4.2-30b-MLX-6bit --prompt "Hello"
      为何暂无估算
      已有格式线索,但估算映射未支持,无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
    • IBM Granite 3B MLX 量化,苹果芯片推理

      参数量
      3B
      商用
      可商用

      当前运行配置 lmstudio-community/granite-4.2-3b-MLX-8bit

      显存
      ~3.3GB 8-bit(估算)
      查看详情
      查看运行方式
      mlx_lm.generate --model lmstudio-community/granite-4.2-3b-MLX-8bit
      许可证
      apache-2.0
      国内可达
      需代理
      其它形态
      8bit · GGUF · 4bit
    • 面向电话语音代理的 30B-A3B 微调模型

      参数量
      30B (3.5B 激活)
      商用
      需自查

      当前运行配置 pipecat-ai/phonellm-alpha-1

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve pipecat-ai/phonellm-alpha-1 --trust-remote-code
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      BSD-2-Clause(含 NVIDIA Nemotron Open Model License)
      上下文
      262k
      国内可达
      需代理
    • Qwen3.8 Flash 的 GGUF 量化,面向本地推理

      参数量
      3.8B
      商用
      需自查

      当前运行配置 lmstudio-community/Qwen3.8-Flash-Next-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf lmstudio-community/Qwen3.8-Flash-Next-GGUF
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      other
      国内可达
      需代理
    • Qwen3.8 GGUF,本地图像文本推理

      参数量
      3.8B
      商用
      需自查

      当前运行配置 orcarouter/Qwen3.8-Flash-Next-Uncensored-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf orcarouter/Qwen3.8-Flash-Next-Uncensored-GGUF
      为何暂无估算
      权重格式未知,无法估算显存
      国内可达
      需代理
    • 面向 RAG 路由的查询重写小模型

      参数量
      270M
      商用
      限制商用

      当前运行配置 Gramscii/SemanticRepair-270M

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      ollama run hf.co/Gramscii/SemanticRepair-270M

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Gemma
      上下文
      2048
      国内可达
      需代理
    • 面向复杂研究任务的推理型 agent 模型

      参数量
      35B-A3B
      商用
      可商用

      当前运行配置 apodex/Apodex-1.1-mini

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve apodex/Apodex-1.1-mini --max-model-len 262144 --enable-auto-tool-choice --tool-call-parser qwen3_coder --reasoning-parser qwen3
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      262144
      国内可达
      需代理
    • Granite 30B MLX 8-bit,本地推理

      参数量
      30B
      商用
      可商用

      当前运行配置 ibm-granite/granite-4.2-30b

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve ibm-granite/granite-4.2-30b
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      128K (可扩展 512K)
      国内可达
      需代理
      其它形态
      原生 · GGUF · 4bit · 8bit
    • Granite 8B MLX 4bit,Mac推理

      参数量
      8B
      商用
      可商用

      当前运行配置 lmstudio-community/granite-4.2-8b-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf lmstudio-community/granite-4.2-8b-GGUF
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
      其它形态
      GGUF · 4bit · 8bit
    • H3×Z-Image 嫁接,ComfyUI 文生视频

      商用
      需自查

      当前运行配置 joeygambino/MiniMax-H3-x-Z-Image-native

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      缺少可用的显存依据
      许可证
      minimax-h3-community-license
      国内可达
      需代理
    • Mac 上 Qwen3.8-27B 4-bit量化

      参数量
      27B
      商用
      可商用

      当前运行配置 Youssofal/Qwen3.8-27B-MTPLX-Optimized-Speed

      显存
      ~16GB 4-bit(估算)
      查看详情
      查看运行方式
      mtplx serve --model Youssofal/Qwen3.8-27B-MTPLX-Optimized-Speed
      许可证
      apache-2.0
      上下文
      262k
      国内可达
      需代理
    • 35B-A3B 编程模型,本地 Agent 编码

      参数量
      35B-A3B
      商用
      可商用

      当前运行配置 peculiar-ragdoll/Tiel-Coder-35B-A3B-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf peculiar-ragdoll/Tiel-Coder-35B-A3B-GGUF --hf-file Tiel-Coder-35B-A3B-UD-Q4_K_XL.gguf -ngl 99 --jinja
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MIT
      国内可达
      需代理
    • 腾讯多模态嵌入模型,支持文本/图像/视频编码,输出 4096 维向量

      参数量
      9B
      商用
      可商用

      当前运行配置 tencent/WeMM-Embedding-9B

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve tencent/WeMM-Embedding-9B --runner pooling
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      国内可达
      需代理
    • 中英文实时TTS,支持语音克隆/设计/定向

      参数量
      3.5B
      商用
      需自查

      当前运行配置 BreezeBlue/Breeze-TTS-2

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      研究/非商业许可;代码 Apache-2.0
      语言
      英文 / 中文
      国内可达
      需代理
    • MiniMax-H3 8步加速 LoRA,面向视频生成

      商用
      可商用

      当前运行配置 alibaba-pai/MiniMax-H3-Acc-LoRAs

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      缺少可用的显存依据
      许可证
      apache-2.0
      上下文
      不适用
      国内可达
      需代理
    • 从 Qwen3.8-27B 切割的 MoE,24GB 本地对话/代码

      参数量
      27B (17.8B active)
      商用
      可商用

      当前运行配置 logic65/Qwen3.8-Whittle-MoE-27B-A17.8B

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf logic65/Qwen3.8-Whittle-MoE-27B-A17.8B -ngl 99 -c 8192 --jinja
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      8k
      国内可达
      需代理
    • MiniMax-H3 流式视频生成 LoRA

      商用
      需自查

      当前运行配置 mvp-lab/MiniMax-H3-RAVEN-Streaming-LoRA

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      缺少可用的显存依据
      许可证
      MiniMax-H3 Community License Agreement
      国内可达
      需代理
    • 27B GGUF 量化,Sharp 模板+MTP,视觉

      参数量
      27B
      商用
      可商用

      当前运行配置 peculiar-ragdoll/Dirk-Qwen3.8-27B-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf peculiar-ragdoll/Dirk-Qwen3.8-27B-GGUF:Q4_K_XL -ngl 99
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      国内可达
      需代理
    • MiniMax-H3 视频控制分支,支持 5 种控制条件与视频修复

      商用
      需自查

      当前运行配置 alibaba-pai/MiniMax-H3-Fun-Controlnet-Union

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      缺少可用的显存依据
      许可证
      MiniMax-H3 Community License Agreement
      国内可达
      需代理
    • 0.17B 零样本语音克隆,中英为主多语种 TTS

      参数量
      0.17B
      商用
      需自查

      当前运行配置 Audio8/Audio8-TTS-Preview-0.1b

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Audio8 Community License v1.0
      上下文
      2048
      语言
      中文(主) · 英文(主) · 德 / 西 / 法 / 意 / 日 / 韩
      国内可达
      需代理
    • ComfyUI 角色表生成,多参考图 360° 一致角色

      商用
      需自查

      当前运行配置 PoopMan333/H3_Character_Sheet_Generator

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      缺少可用的显存依据
      许可证
      minimax-h3-community-license (EU/UK/韩国/美国除外)
      国内可达
      需代理
    • 为 Qwen3.8-27B 提供投机解码加速的草案模型

      参数量
      1.9B
      商用
      可商用

      当前运行配置 z-lab/Qwen3.8-27B-DFlash2

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve Qwen/Qwen3.8-27B --speculative-config '{"method":"dflash","model":"z-lab/Qwen3.8-27B-DFlash2","num_speculative_tokens":7}'
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      128k
      国内可达
      需代理
      其它形态
      原生·z-lab · 原生·incoai · GGUF·incoai · GGUF·z-lab
    • 2-bit 量化 27B 模型,24GB 显卡 64k 上下文

      参数量
      27B
      商用
      可商用

      当前运行配置 EschaLabs/Qwen3.8-27B-Escha-W2

      显存
      ~9.2GB 2-bit(估算)
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      许可证
      Apache-2.0
      上下文
      128k
      国内可达
      需代理
    • 无审查 Qwen3.8-27B 动态量化 GGUF,本地推理

      参数量
      27B
      商用
      可商用

      当前运行配置 outsourc-e/Qwen3.8-27B-Unleashed-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      ollama run hf.co/outsourc-e/Qwen3.8-27B-Unleashed-GGUF

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      262k
      国内可达
      需代理
    • 35B MoE 激活 3B,面向工具调用与长上下文推理

      参数量
      35B MoE / 激活 3B
      商用
      可商用

      当前运行配置 ornith-ai/Ornith-1.5-35B-A3B

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve ornith-ai/Ornith-1.5-35B-A3B --trust-remote-code --reasoning-parser qwen3 --tool-call-parser qwen3_xml --enable-auto-tool-choice
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MIT
      上下文
      262k
      国内可达
      需代理
      其它形态
      原生 · GGUF
    • ASR 后处理文本规范化器,英文听写与字幕管道用

      参数量
      0.6B
      商用
      需自查

      当前运行配置 superwhisper/s1-mini

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf superwhisper/s1-mini-GGUF:Q4_K_M --jinja --chat-template-kwargs '{"enable_thinking":false}' --temp 0
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache 2.0 + 命名条款
      国内可达
      需代理
    • Mac 用 Qwen3.6-27B MLX 量化,低冗余输出

      参数量
      27B
      商用
      可商用

      当前运行配置 peculiar-ragdoll/Dagger-Qwen3.6-27B-MLX

      显存
      暂无估算
      查看详情
      查看运行方式
      mlx_lm.generate --model peculiar-ragdoll/Dagger-Qwen3.6-27B-MLX
      为何暂无估算
      已有格式线索,但估算映射未支持,无法估算显存
      许可证
      Apache-2.0
      上下文
      256k
      国内可达
      需代理
    • 8B-A1B 投机解码草稿侧车,配 llama.cpp 加速

      参数量
      8B
      商用
      需自查

      当前运行配置 LiquidAI/LFM2.5-8B-A1B-DSpark-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      ollama run hf.co/LiquidAI/LFM2.5-8B-A1B-DSpark-GGUF
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      other (lfm1.0)
      国内可达
      需代理
    • 9B 稠密推理模型,单卡部署与终端编程

      参数量
      9B
      商用
      可商用

      当前运行配置 ornith-ai/Ornith-1.5-9B

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve ornith-ai/Ornith-1.5-9B --served-model-name Ornith-1.5-9B --max-model-len 262144 --enable-auto-tool-choice --tool-call-parser qwen3_xml --reasoning-parser qwen3 --trust-remote-code
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MIT
      上下文
      262k(YaRN 可扩展至约 1M)
      国内可达
      需代理
      其它形态
      原生 · GGUF
    • 无审查 Qwen3.8-27B,供红队与对齐研究

      参数量
      27B
      商用
      可商用

      当前运行配置 OBLITERATUS/Qwen3.8-27B-OBLITERATED

      显存
      暂无估算
      查看详情
      查看运行方式
      ollama run hf.co/OBLITERATUS/Qwen3.8-27B-OBLITERATED
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      国内可达
      需代理
    • 去拒绝版 Qwen3.8-27B GGUF,多模态本地推理

      参数量
      27B
      商用
      可商用

      当前运行配置 huihui-ai/Huihui-Qwen3.8-27B-abliterated-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      ollama run huihui_ai/Qwen3.8-abliterated
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      262k
      国内可达
      需代理
    • Qwen3.8-27B 去安全限制 GGUF,供角色扮演与创作

      参数量
      27B
      商用
      可商用

      当前运行配置 0bserverx/Qwen3.8-27B-Heretic-Abliterated-Uncensored-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      ollama run hf.co/0bserverx/Qwen3.8-27B-Heretic-Abliterated-Uncensored-GGUF

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      262k
      国内可达
      需代理
    • Qwen3.8-27B 微调 GGUF,减思考 token 支持视觉

      参数量
      27B
      商用
      可商用

      当前运行配置 DavidAU/Qwen3.8-27B-Cold-Fusion-GAIN-V1.1-NM-DAU-NEO-MAX-MTP-GGUF

      显存
      ~57GB BF16(估算)
      查看详情
      查看运行方式
      llama-server -hf DavidAU/Qwen3.8-27B-Cold-Fusion-GAIN-V1.1-NM-DAU-NEO-MAX-MTP-GGUF
      许可证
      Apache-2.0
      上下文
      256k
      国内可达
      需代理
    • 27B 图像-文本到文本 GGUF,本地推理

      参数量
      27B
      商用
      可商用

      当前运行配置 orcarouter/Qwen3.8-27B-Uncensored-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf orcarouter/Qwen3.8-27B-Uncensored-GGUF
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      262k
      国内可达
      需代理
      其它形态
      GGUF·orcarouter · GGUF·jonathancoletti
    • 27B 未审查 GGUF,带视觉与 FastMTP

      参数量
      27B
      商用
      可商用

      当前运行配置 HauhauCS/Qwen3.8-27B-Uncensored-HauhauCS-Aggressive-MTP-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf HauhauCS/Qwen3.8-27B-Uncensored-HauhauCS-Aggressive-MTP-GGUF --jinja
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      262k 原生
      国内可达
      需代理
    • 全参蒸馏 9B 推理模型,面向数学/代码/工具调用

      参数量
      9B
      商用
      可商用

      当前运行配置 empero-ai/Qwen3.8-9B-Distill

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve empero-ai/Qwen3.8-9B-Distill
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      262k
      国内可达
      需代理
      其它形态
      原生 · GGUF
    • Qwen3.8-27B 量化版,本地图文对话与转写

      参数量
      27B
      商用
      可商用

      当前运行配置 lmstudio-community/Qwen3.8-27B-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf lmstudio-community/Qwen3.8-27B-GGUF
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      262k
      国内可达
      需代理
      其它形态
      GGUF·lmstudio · GGUF·atomicchat · GGUF·unsloth
    • 9B 蒸馏推理模型,面向数学/代码/工具调用

      参数量
      9B
      商用
      可商用

      当前运行配置 empero-ai/Qwen3.8-9B

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve empero-ai/Qwen3.8-9B
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      262k
      国内可达
      需代理
    • 给心理支持对话逐句打五维评分,供本地部署

      参数量
      0.6B
      商用
      限制商用

      当前运行配置 HamoAI/hamo-score-0.6b

      显存
      暂无估算
      查看详情
      查看运行方式
      ollama run hf.co/HamoAI/hamo-score-0.6b
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      HAMO-RAIL-S 1.0
      国内可达
      需代理
    • Gemma 3 4B 蒸馏微调对话模型,面向轻量试验与聊天

      参数量
      4B
      商用
      需自查

      当前运行配置 VertexAIco/amethyst-1-mini

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf VertexAIco/amethyst-1-mini
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Gemma Terms of Use
      上下文
      1024
      国内可达
      需代理
    • GGUF 量化 27B 图文模型,供 llama.cpp 本地部署

      参数量
      27B
      商用
      可商用

      当前运行配置 Blackfrost-AI/Qwen3.8-27B-ABLITERATED-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf Blackfrost-AI/Qwen3.8-27B-ABLITERATED-GGUF:Q4_K_M -ngl 999 --jinja -c 16384
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      262k
      国内可达
      需代理
    • Qwen3.8-27B 混合量化 GGUF,本地图文推理

      参数量
      27B
      商用
      可商用

      当前运行配置 empero-ai/Qwen3.8-27B-Ridge-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      ollama run hf.co/empero-ai/Qwen3.8-27B-Ridge-GGUF
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      262k / YaRN 1M
      国内可达
      需代理
    • Qwen3.6-27B 无审查多模态 GGUF,本地部署

      参数量
      27B
      商用
      可商用

      当前运行配置 HauhauCS/Qwen3.6-27B-Uncensored-HauhauCS-Aggressive

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf HauhauCS/Qwen3.6-27B-Uncensored-HauhauCS-Aggressive --jinja -c 131072 -ngl 99
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      262k(可扩展至 ~1M)
      国内可达
      需代理
    • 2.6B 5-bit MLX 量化,Mac 本地推理

      参数量
      2.6B
      商用
      需自查

      当前运行配置 lmstudio-community/LFM2.5-2.6B-MLX-5bit

      显存
      暂无估算
      查看详情
      查看运行方式
      mlx_lm.generate --model lmstudio-community/LFM2.5-2.6B-MLX-5bit
      为何暂无估算
      已有格式线索,但估算映射未支持,无法估算显存
      许可证
      LFM Open License v1.0
      国内可达
      需代理
    • 零样本语音克隆,支持中英日西阿,单音频参考

      参数量
      0.8B
      商用
      需自查

      当前运行配置 IndexTeam/IndexTTS-2.5

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      bilibili-model-license
      语言
      中文 / 英文 / 日语 / 西班牙语 / 阿拉伯语
      国内可达
      魔搭可用
    • MiniMax H3 图像模型集,WanGP 可用

      参数量
      32B
      商用
      需自查

      当前运行配置 DeepBeepMeep/MiniMax-H3

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MiniMax H3 Community License (有地域限制)
      上下文
      不适用
      国内可达
      需代理
      其它形态
      原生 · GGUF·abiray · GGUF·unsloth
    • 30B GGUF 量化模型,供 LM Studio 本地推理

      参数量
      30B
      商用
      需自查

      当前运行配置 lmstudio-community/Muse-Glimmer-30B-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf lmstudio-community/Muse-Glimmer-30B-GGUF
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache 2.0
      上下文
      128k+
      国内可达
      需代理
      其它形态
      GGUF·lmstudio · GGUF·meta-models · GGUF·unsloth
    • 30B 总参 / 3B 激活 MoE,本地 GGUF 部署

      参数量
      30B (A3B 激活)
      商用
      需自查

      当前运行配置 nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16

      显存
      ~63GB BF16(估算)
      查看详情
      查看运行方式
      vllm serve nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16
      许可证
      OpenMDW-1.1
      上下文
      1M
      国内可达
      需代理
      其它形态
      原生 · GGUF
    • Wan 视频模型 GGUF 量化仓库,本地推理用

      参数量
      4B
      商用
      需自查

      当前运行配置 MonsterMMORPG/Wan_GGUF

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      国内可达
      需代理
    • 动漫/插画文本生图模型,面向二次元创作者

      参数量
      2.9B
      商用
      需自查

      当前运行配置 Gazingstars123/Anima-2.9B

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      CircleStone Labs Non-Commercial License
      国内可达
      需代理
    • ComfyUI 用 Qwen3-VL 4B/8B 替代 H3 编码器

      参数量
      4B
      商用
      需自查

      当前运行配置 NicoLab28/ClipProj-MiniMax-H3

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MIT(投影矩阵);基座模型 Apache 2.0 / MiniMax 自定义许可
      国内可达
      需代理
    • 45M 工具调用模型,14MB 二进制跑边缘设备

      参数量
      45M
      商用
      可商用

      当前运行配置 Cactus-Compute/needle2

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      256 tokens
      国内可达
      需代理
    • MiniMax-H3 真人写实 LoRA,专攻人像与日常场景视频生成

      商用
      需自查

      当前运行配置 fal/MiniMax-H3-Realism-People-LoRA

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      缺少可用的显存依据
      许可证
      minimax-h3-community-license
      国内可达
      需代理
    • 3B活跃参数,面向本地Agent和长上下文推理

      参数量
      30B (3B active)
      商用
      需自查

      当前运行配置 nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4
      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      OpenMDW-1.1
      上下文
      1M
      国内可达
      需代理
    • 6-bit MLX 量化推理模型,为 Apple Silicon 优化

      参数量
      2.6B
      商用
      需自查

      当前运行配置 lmstudio-community/LFM2.5-2.6B-MLX-6bit

      显存
      暂无估算
      查看详情
      查看运行方式
      mlx_lm.generate --model lmstudio-community/LFM2.5-2.6B-MLX-6bit
      为何暂无估算
      已有格式线索,但估算映射未支持,无法估算显存
      许可证
      LFM-1.0
      国内可达
      需代理
    • 1M 上下文旗舰模型,适合复杂长程任务开发

      参数量
      753.3B
      商用
      可商用

      当前运行配置 Scrappy-Doo/GLM-5.2

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve Scrappy-Doo/GLM-5.2 --trust-remote-code
      为何暂无估算
      缺少可用的参数量依据,无法估算显存
      许可证
      MIT
      上下文
      1M
      国内可达
      需代理
      其它形态
      原生·scrappy-doo · GGUF · 原生·zai-org
    • 3B Agent 模型 GGUF 量化版本,用于资源受限部署

      参数量
      3B
      商用
      需自查

      当前运行配置 Nanbeige/Nanbeige4.2-3B

      显存
      暂无估算
      查看详情
      查看运行方式
      ollama run nanbeige/nanbeige4.2:3b-Q4_K_M
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache 2.0
      上下文
      131k
      国内可达
      需代理
      其它形态
      原生 · GGUF
    • Apple Silicon 用 4-bit 量化 LFM,始终思考模式

      参数量
      2.6B
      商用
      需自查

      当前运行配置 LiquidAI/LFM2.5-2.6B

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf LiquidAI/LFM2.5-2.6B-GGUF
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      LFM Open License v1.0
      上下文
      128k
      国内可达
      需代理
      其它形态
      原生 · GGUF·liquidai · GGUF·lmstudio · 4bit · 8bit
    • Apple Silicon 本地推理的 MLX 6-bit 量化模型

      参数量
      35.1B
      商用
      可商用

      当前运行配置 AutomatosX/AX-Qwen3.6-35B-A3B-MLX-AXQ-6bit-MTP

      显存
      暂无估算
      查看详情
      查看运行方式
      mlx_lm.generate --model AutomatosX/AX-Qwen3.6-35B-A3B-MLX-AXQ-6bit-MTP
      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      Apache-2.0
      上下文
      262k
      国内可达
      需代理
    • 面向工具调用与软件工程的35B推理模型

      参数量
      35B
      商用
      需自查

      当前运行配置 badtheorylabs/BTL-4

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve badtheorylabs/BTL-4 --max-model-len 131072 --enable-auto-tool-choice --tool-call-parser qwen3_xml --reasoning-parser qwen3 --trust-remote-code
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache 2.0
      上下文
      262k
      国内可达
      需代理
    • 将角色图片转为三视图、四视图及动态角色设定表的 LoRA 集合

      商用
      需自查

      当前运行配置 Alissonerdx/CharacterSheet

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      缺少可用的显存依据
      许可证
      Civitai 模型许可
      上下文
      不适用
      国内可达
      需代理
    • 20B-A1B 三元推理模型,M4 218 tok/s

      参数量
      20B-A1B
      商用
      可商用

      当前运行配置 deepgrove/maple-preview

      显存
      ~5.4GB ternary(估算)
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      许可证
      MIT
      上下文
      131k
      国内可达
      需代理
    • 通用文本生成的MLX量化版,供Apple Silicon本地使用

      参数量
      9B
      商用
      可商用

      当前运行配置 lmstudio-community/Ornith-1.0-9B-MLX-5bit

      显存
      暂无估算
      查看详情
      查看运行方式
      mlx_lm.generate --model lmstudio-community/Ornith-1.0-9B-MLX-5bit
      为何暂无估算
      已有格式线索,但估算映射未支持,无法估算显存
      许可证
      MIT
      国内可达
      需代理
    • 5.7B MoE,融合LFM2与Qwen编码专家,用于代码生成

      参数量
      5.7B
      商用
      需自查

      当前运行配置 Akahsizrr/fuse-1-Lite

      显存
      暂无估算
      查看详情
      查看运行方式
      mlx_lm.generate --model Akahsizrr/fuse-1-Lite-MLX --trust-remote-code
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache 2.0
      国内可达
      需代理
    • MiniMax H3 视频模型 GGUF 版,ComfyUI 用

      参数量
      32B
      商用
      需自查

      当前运行配置 realrebelai/MiniMax-H3_GGUFs

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      国内可达
      需代理
    • MiniMax-H3 4步加速LoRA,ComfyUI 专用

      商用
      可商用

      当前运行配置 drbaph/MiniMax-H3-Turbo-Lora-ComfyUI

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      缺少可用的显存依据
      许可证
      apache-2.0
      国内可达
      需代理
    • 4步生成同步音视频的 MiniMax-H3 加速 LoRA

      商用
      可商用

      当前运行配置 larryvrh/MiniMax-H3-Turbo-Lora

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      缺少可用的显存依据
      许可证
      apache-2.0
      国内可达
      需代理
    • 多语言嵌入,支持稠密/稀疏/多向量检索,8k上下文

      商用
      可商用

      当前运行配置 BAAI/bge-m3

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      缺少可用的参数量依据,无法估算显存
      许可证
      MIT
      上下文
      8192
      国内可达
      需代理
    • 未审查 DeepSeek-V4-Flash GGUF,供研究测试

      商用
      可商用

      当前运行配置 huihui-ai/Huihui-DeepSeek-V4-Flash-0731-abliterated-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      ollama run hf.co/huihui-ai/Huihui-DeepSeek-V4-Flash-0731-abliterated-GGUF

      其它 1 种运行方式见详情页

      为何暂无估算
      缺少可用的参数量依据,无法估算显存
      许可证
      MIT
      上下文
      256k
      国内可达
      需代理
    • Krea 2 的 LoRA 适配器,ComfyUI 直接加载

      商用
      可商用

      当前运行配置 lodestones/Kroma

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      缺少可用的显存依据
      许可证
      MIT
      国内可达
      需代理
    • 8B 指令微调模型,用于通用对话与文本生成任务

      参数量
      8B
      商用
      需自查

      当前运行配置 meta-llama/Llama-3.1-8B-Instruct

      显存
      暂无估算
      查看详情
      查看运行方式
      ollama run hf.co/meta-llama/Llama-3.1-8B-Instruct
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Llama 3.1 Community License
      上下文
      128k
      国内可达
      需代理
    • Qwen2.5 7B 指令模型,用于多语言对话与长文本生成。

      参数量
      7B
      商用
      可商用

      当前运行配置 Qwen/Qwen2.5-7B-Instruct

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve Qwen/Qwen2.5-7B-Instruct
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      128k
      国内可达
      需代理
    • 带 MTP 自推测解码的 GGUF 量化版,加速本地推理

      参数量
      27B
      商用
      可商用

      当前运行配置 ManniX-ITA/Qwen3.6-27B-Omnimerge-v4-MTP-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf ManniX-ITA/Qwen3.6-27B-Omnimerge-v4-MTP-GGUF -m Qwen3.6-27B-Omnimerge-v4-Q6_K.gguf --spec-type draft-mtp --spec-draft-n-max 3 -ngl 99 -c 16384
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      128k
      国内可达
      需代理
    • 35B MoE多模态GGUF,无审查角色扮演与函数调用代理

      参数量
      35B (3B激活)
      商用
      可商用

      当前运行配置 LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V7-GGUF

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      262K (可扩至1M)
      国内可达
      需代理
    • 多语言语音识别与翻译,零样本泛化

      参数量
      1.55B
      商用
      需自查

      当前运行配置 openai/whisper-large-v3

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache 2.0
      上下文
      30s 音频
      国内可达
      需代理
      其它形态
      原生 · MLX
    • ds4引擎 DeepSeek-V4-Flash 量化,Mac 本地运行

      商用
      可商用

      当前运行配置 antirez/deepseek-v4-gguf

      显存
      暂无估算
      查看详情
      查看运行方式
      ollama run hf.co/antirez/deepseek-v4-gguf
      为何暂无估算
      缺少可用的参数量依据,无法估算显存
      许可证
      MIT
      上下文
      100k
      国内可达
      需代理
    • 把粗糙提示变成结构化详细提示,方便交给任意模型

      参数量
      31.6B
      商用
      需自查

      当前运行配置 thunkaboutit/Koleslaw-Nemotron-30B-A3B-PromptEnhance

      显存
      暂无估算
      查看详情
      查看运行方式
      ollama run hf.co/thunkaboutit/Koleslaw-Nemotron-30B-A3B-PromptEnhance
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      NVIDIA Nemotron Open Model License
      上下文
      8K
      国内可达
      需代理
    • MLX 6-bit 35B,用于 Apple Silicon 文本生成

      参数量
      35B
      商用
      可商用

      当前运行配置 lmstudio-community/Ornith-1.0-35B-MLX-6bit

      显存
      暂无估算
      查看详情
      查看运行方式
      mlx_lm.generate --model lmstudio-community/Ornith-1.0-35B-MLX-6bit
      为何暂无估算
      已有格式线索,但估算映射未支持,无法估算显存
      许可证
      MIT
      国内可达
      需代理
    • MLX量化9B文本模型,苹果芯片本地推理

      参数量
      9B
      商用
      可商用

      当前运行配置 lmstudio-community/Ornith-1.0-9B-MLX-6bit

      显存
      暂无估算
      查看详情
      查看运行方式
      mlx_lm.generate --model lmstudio-community/Ornith-1.0-9B-MLX-6bit
      为何暂无估算
      已有格式线索,但估算映射未支持,无法估算显存
      许可证
      MIT
      国内可达
      需代理
    • 多语种TTS,细粒度韵律/情感内联控制,80+语言

      参数量
      4B + 400M
      商用
      需自查

      当前运行配置 fishaudio/s2-pro

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      fish-audio-research-license
      语言
      日 / 英 / 中 (主) · 韩 / 西 / 葡 / 阿 / 俄 / 法 / 德等80+语言
      国内可达
      需代理
    • 69B MoE,仅3B激活,1M上下文,面向Agent与长文本任务

      参数量
      69B (激活 3B)
      商用
      可商用

      当前运行配置 meituan-longcat/LongCat-Flash-Lite-Sparse

      显存
      暂无估算
      查看详情
      查看运行方式
      python3 -m sglang.launch_server --model meituan-longcat/LongCat-Flash-Lite-Sparse --trust-remote-code --chunked-prefill-size 2048 --nsa-prefill-backend fa3 --kv-cache-dtype bfloat16
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MIT
      上下文
      1M
      国内可达
      需代理
    • 在 Apple Silicon 上运行的 35B 文本生成模型

      参数量
      35B
      商用
      可商用

      当前运行配置 deepreinforce-ai/Ornith-1.0-35B

      显存
      暂无估算
      查看详情
      查看运行方式(还有 2 种)
      llama-server -hf deepreinforce-ai/Ornith-1.0-35B-GGUF --port 8000 -c 262144

      其它 2 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      mit
      上下文
      256k
      国内可达
      需代理
      其它形态
      原生 · FP8 · GGUF·deepreinforce-ai · GGUF·lmstudio · 4bit · 8bit · GGUF·unsloth
    • 苹果硅本地运行的 35B 文本生成模型

      参数量
      35B
      商用
      可商用

      当前运行配置 lmstudio-community/Ornith-1.0-35B-MLX-5bit

      显存
      暂无估算
      查看详情
      查看运行方式
      mlx_lm.generate --model lmstudio-community/Ornith-1.0-35B-MLX-5bit
      为何暂无估算
      已有格式线索,但估算映射未支持,无法估算显存
      许可证
      mit
      国内可达
      需代理
    • MLX 8-bit量化,为Apple Silicon优化

      参数量
      9B
      商用
      可商用

      当前运行配置 deepreinforce-ai/Ornith-1.0-9B

      显存
      暂无估算
      查看详情
      查看运行方式(还有 2 种)
      llama-server -hf deepreinforce-ai/Ornith-1.0-9B-GGUF --port 8000 -c 262144

      其它 2 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      mit
      上下文
      256k
      国内可达
      需代理
      其它形态
      原生 · GGUF·deepreinforce-ai · GGUF·lmstudio · 4bit · 8bit · GGUF·protolabsai
    • DeepSeek V4 系列轻量模型,本地快速对话

      商用
      可商用

      当前运行配置 lmstudio-community/DeepSeek-V4-Flash-0731-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      ollama run hf.co/lmstudio-community/DeepSeek-V4-Flash-0731-GGUF
      为何暂无估算
      缺少可用的参数量依据,无法估算显存
      许可证
      MIT
      国内可达
      需代理
      其它形态
      GGUF·lmstudio · GGUF·unsloth
    • 多模态文本/图像/音频输入,GGUF 量化,适合本地运行。

      参数量
      12B (激活, 276B 总)
      商用
      可商用

      当前运行配置 unsloth/Inkling-Small-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      ollama run hf.co/unsloth/Inkling-Small-GGUF
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
    • 轻量级Kimi-K3测试版,保留混合注意力MoE,用于特征提取开发

      参数量
      0.40B
      商用
      可商用

      当前运行配置 inference-optimization/Kimi-K3-0.40B

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MIT
      国内可达
      需代理
    • 子 2 比特 8B 聊天模型,容器 2.56 GB

      参数量
      8B
      商用
      可商用

      当前运行配置 FermionResearch/Neutrino-8B

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      ollama run hf.co/FermionResearch/Neutrino-8B

      其它 1 种运行方式见详情页

      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      Apache-2.0
      上下文
      40k
      国内可达
      需代理
    • 多模态 27B 模型,纯 Q1_0 量化,语言部分仅 3.8 GB

      参数量
      27B
      商用
      可商用

      当前运行配置 prism-ml/Bonsai-27B-gguf

      显存
      ~4.1GB 1-bit(估算)
      查看详情
      查看运行方式(还有 1 种)
      ollama run hf.co/prism-ml/Bonsai-27B-gguf

      其它 1 种运行方式见详情页

      许可证
      Apache-2.0
      上下文
      262K
      国内可达
      需代理
      其它形态
      GGUF·prism-ml · GGUF·lmstudio
    • 0.6B多语言TTS,零样本语音克隆,支持11种语言

      参数量
      0.6B
      商用
      可商用

      当前运行配置 Audio8/Audio8-TTS-Preview-0.6b

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      2048
      语言
      粤语 / 中文 / 荷兰语 / 英语 / 法语 / 德语 / 意大利语 / 日语 / 韩语 / 波兰语 / 西班牙语
      国内可达
      需代理
    • 可控逐字/意图风格的多语言ASR,精准词级时间戳

      参数量
      1.55B
      商用
      需自查

      当前运行配置 nyralabs/CrisperWhisper2.0_large

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      非商业研究许可
      上下文
      30s音频窗口,长音频自动拼接
      国内可达
      需代理
    • Mixture of LoRA 个人助手与工具编码模型

      参数量
      35B (激活 3B)
      商用
      可商用

      当前运行配置 mindlab-research/Macaron-V1-Tall

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MIT
      上下文
      262k
      国内可达
      需代理
    • 2-bit Qwen3.6-35B-A3B,12.3GB,单卡本地推理

      参数量
      35B (3B active)
      商用
      可商用

      当前运行配置 EschaLabs/Qwen3.6-35B-A3B-Escha-W2

      显存
      ~12GB 2-bit(估算)
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      许可证
      Apache-2.0
      上下文
      128k
      国内可达
      需代理
    • 融合推理与代码的27B单模型,适合本地编程代理

      参数量
      27B
      商用
      需自查

      当前运行配置 KyleHessling1/Qwopus3.6-27B-Fusion-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      ollama run hf.co/KyleHessling1/Qwopus3.6-27B-Fusion-GGUF

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Qwen License
      上下文
      262k
      国内可达
      需代理
    • 15语TTS GGUF,离线CPU运行

      参数量
      82M
      商用
      需自查

      当前运行配置 Nanthasit/sakthai-tts-model

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MIT (包装) / Apache 2.0 (Kokoro)
      上下文
      不适用
      语言
      英/日/中/韩/法/西/葡/意/德/波/俄/阿/印/孟/泰
      国内可达
      需代理
    • 面向深度搜索的开放权重思考模型

      参数量
      35B (3B 激活)
      商用
      需自查

      当前运行配置 XYZAILab/XYZ-Aquila-mini

      显存
      暂无估算
      查看详情
      查看运行方式
      python -m sglang.launch_server --model-path XYZAILab/XYZ-Aquila-mini --reasoning-parser qwen3 --tool-call-parser qwen3_coder
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache 2.0
      上下文
      256k
      国内可达
      魔搭可用
    • Gemma 4 98e coder GGUF量化,本地代码生成与推理

      参数量
      20.8B (4B active MoE)
      商用
      限制商用

      当前运行配置 ManniX-ITA/gemma-4-A4B-98e-v6-coder-it-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      ollama run mannix/gemma4-98e-v6-coder
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Gemma
      上下文
      32k
      国内可达
      需代理
    • 边缘工具调用模型,基于 Qwen2.5-0.5B,可在树莓派运行

      参数量
      0.5B
      商用
      可商用

      当前运行配置 Nanthasit/sakthai-context-0.5b-merged

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      ollama run hf.co/Nanthasit/sakthai-context-0.5b-merged

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
    • LLaVA-1.5-7B GGUF 量化,本地图像描述与视觉问答

      参数量
      7B
      商用
      需自查

      当前运行配置 Nanthasit/sakthai-vision-7b

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      LLaMA 2 Community
      上下文
      4k
      国内可达
      需代理
    • 全开源 MoE 语言模型,16B 总参/2.8B 激活,面向研究

      参数量
      16B
      商用
      限制商用

      当前运行配置 amd/Instella-MoE-16B-A3B-Think

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      ResearchRAIL
      国内可达
      需代理
    • 四步DMD2蒸馏,快速文本生成图像,开发者评估

      参数量
      20.43B
      商用
      需自查

      当前运行配置 nvidia/Qwen-Image-Flash

      显存
      暂无估算
      查看详情
      查看运行方式
      sglang generate --model-path nvidia/Qwen-Image-Flash --prompt "A red fox in a snowy pine forest at golden hour, photorealistic, sharp focus, soft bokeh" --width 1024 --height 1024 --num-inference-steps 4 --guidance-scale 1.0 --true-cfg-scale 1.0 --seed 42 --save-output --output-file-path qwen-image-flash-sglang.png
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      NVIDIA Open Model Agreement
      国内可达
      需代理
    • 无审查多模态MoE,经Genesis去噪,适合角色扮演和代理

      参数量
      35B (3B active)
      商用
      可商用

      当前运行配置 LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V6-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V6-GGUF --jinja -ngl 99
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      262K
      国内可达
      需代理
    • 边缘CPU实时多语言语音识别,压缩至1.58GB

      参数量
      323M
      商用
      可商用

      当前运行配置 microsoft/VibeVoice-ASR-BitNet

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MIT
      国内可达
      需代理
    • 4M参数本地英文TTS,CPU实时推理

      参数量
      3.97M
      商用
      可商用

      当前运行配置 owensong/Inflect-Nano-v2

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      不适用
      语言
      英文
      国内可达
      需代理
    • 全Apple Silicon训练·推理优先微调·4B预览版

      参数量
      4B
      商用
      可商用

      当前运行配置 Goekdeniz-Guelmez/JOSIE-2-4B-Preview

      显存
      暂无估算
      查看详情
      查看运行方式
      mlx_lm.generate --model Goekdeniz-Guelmez/JOSIE-2-4B-Preview
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MIT
      国内可达
      需代理
    • 虚构机构的对话神谕,面向艺术与超虚构创作

      参数量
      14B
      商用
      可商用

      当前运行配置 gokhanturhan/CLINAMEN-Chat

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MIT
      国内可达
      需代理
    • 9.36M 参数完整本地 TTS,固定男声英语言语合成

      参数量
      9.36M
      商用
      可商用

      当前运行配置 owensong/Inflect-Micro-v2

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      无限制(标点分块)
      语言
      英文
      国内可达
      需代理
    • 代码生成小模型,GGUF 量化版

      参数量
      33B (3B 激活)
      商用
      需自查

      当前运行配置 poolside/Laguna-XS-2.1

      显存
      暂无估算
      查看详情
      查看运行方式
      ollama run laguna-xs-2.1
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      openmdw-1.1
      上下文
      262k
      国内可达
      需代理
      其它形态
      原生 · GGUF
    • 4步蒸馏的4B文本到图像模型,适用快速出图

      参数量
      4B
      商用
      可商用

      当前运行配置 microsoft/Mage-Flow-Turbo

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MIT
      上下文
      不适用
      国内可达
      需代理
    • 43.8M 意英双语对话模型,专为 CPU 环境的意大利语问答设计

      参数量
      43.8M
      商用
      可商用

      当前运行配置 ThingAI/Quak-50m-v2

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      2048
      国内可达
      需代理
    • 1B 参数语言模型,用于轻量推理与微调实验

      参数量
      1B
      商用
      需自查

      当前运行配置 fdtn-ai/antares-1b

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      国内可达
      需代理
    • 直接生成可执行ELF hex的文本模型

      参数量
      约4.3B (基于F16.gguf 8.6GiB推断)
      商用
      可商用

      当前运行配置 matthewhaynesonline/gemma-4-E2B-it-crap-gguf

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      ollama run hf.co/matthewhaynesonline/gemma-4-E2B-it-crap-gguf

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      国内可达
      需代理
    • 27B 令牌高效推理模型,用于智能体与工具调用

      参数量
      27B
      商用
      可商用

      当前运行配置 ProCreations/grug-27b

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve ProCreations/grug-27b --reasoning-parser qwen3 --max-model-len 32768
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      国内可达
      需代理
    • 27B 开源代理模型,面向代理编程与结构化工具调用

      参数量
      27B
      商用
      可商用

      当前运行配置 badtheorylabs/BTL-3

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve Qwen/Qwen3.6-27B --revision 6a9e13bd6fc8f0983b9b99948120bc37f49c13e9 --served-model-name BTL-3 --enable-lora --max-lora-rank 32 --lora-modules BTL-3=badtheorylabs/BTL-3 --lora-target-modules q_proj k_proj v_proj o_proj in_proj_qkv in_proj_z in_proj_b in_proj_a out_proj gate_proj up_proj down_proj --reasoning-parser qwen3 --language-model-only --max-model-len 32768
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      262k
      国内可达
      需代理
    • Grok-3推理蒸馏Gemma3-4B的GGUF量化版

      参数量
      4B
      商用
      可商用

      当前运行配置 mradermacher/Grok-3-reasoning-gemma3-4B-distilled-HF-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      ollama run hf.co/mradermacher/Grok-3-reasoning-gemma3-4B-distilled-HF-GGUF
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      国内可达
      需代理
    • poolside 代码模型,GGUF 量化版,适用于本地运行

      商用
      需自查

      当前运行配置 poolside/Laguna-S-2.1-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf poolside/Laguna-S-2.1-GGUF -m laguna-s-2.1-Q4_K_M.gguf --jinja
      为何暂无估算
      缺少可用的参数量依据,无法估算显存
      许可证
      openmdw-1.1
      上下文
      256K
      国内可达
      需代理
      其它形态
      GGUF·poolside · GGUF·lmstudio
    • 无审查9B多模态模型,提升推理与指令跟随

      参数量
      9B
      商用
      需自查

      当前运行配置 DavidAU/Qwen3.5-9B-The-Defiant-Fable-Uncensored-Heretic-NEO-IMATRIX-MAX-MTP-GGUF

      显存
      ~19GB BF16(估算)
      查看详情
      查看运行方式
      llama-server -hf DavidAU/Qwen3.5-9B-The-Defiant-Fable-Uncensored-Heretic-NEO-IMATRIX-MAX-MTP-GGUF
      许可证
      Apache 2.0
      上下文
      256k
      国内可达
      需代理
    • 35B MoE编程代理模型,为代码修复与终端任务设计

      参数量
      35B(3B激活)
      商用
      可商用

      当前运行配置 Kwaipilot/KAT-Coder-V2.5-Dev

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve Kwaipilot/KAT-Coder-V2.5-Dev --language-model-only --reasoning-parser qwen3
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      256k
      国内可达
      需代理
    • 4B 指令式图像编辑 Turbo 模型,4 步蒸馏推理

      参数量
      4B
      商用
      可商用

      当前运行配置 microsoft/Mage-Flow-Edit-Turbo

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MIT
      国内可达
      需代理
    • 35B 韩语模型,在 iPhone/Mac 上用 MLX 本地运行

      参数量
      35B
      商用
      可商用

      当前运行配置 FINAL-Bench/POCKET-KR-MLX

      显存
      ~12GB 2-bit(估算)
      查看详情
      查看运行方式
      mlx_lm.generate --model FINAL-Bench/POCKET-KR-MLX
      许可证
      Apache-2.0
      国内可达
      需代理
    • 无审查多模态 MoE,支持 Hermes 工具调用,为创作者

      参数量
      35B (激活 3B)
      商用
      可商用

      当前运行配置 LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V5-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V5-GGUF --jinja
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      262K (可扩展至 1M)
      国内可达
      需代理
    • 117.6B MoE (8.5B 激活) 代理编码模型,本地设备可运行

      参数量
      117.6B (8.5B 激活)
      商用
      需自查

      当前运行配置 poolside/Laguna-S-2.1-NVFP4

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve poolside/Laguna-S-2.1-NVFP4
      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      OpenMDW-1.1
      上下文
      256K
      国内可达
      需代理
    • 紧凑4B原生分辨率文本图像生成与编辑模型

      参数量
      4B
      商用
      可商用

      当前运行配置 microsoft/Mage-Flow

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MIT
      国内可达
      需代理
    • 面向 Apple Silicon 的多模态量化模型,文本+图像

      参数量
      35B
      商用
      可商用

      当前运行配置 AtomicChat/ornith-35b-MLX-8bit

      显存
      ~39GB 8-bit(估算)
      查看详情
      查看运行方式
      mlx_lm.generate --model AtomicChat/ornith-35b-MLX-8bit --prompt Hello
      许可证
      MIT
      上下文
      256K
      国内可达
      需代理
    • 35B MoE MLX 量化,Mac 本地多模态推理

      参数量
      35B
      商用
      可商用

      当前运行配置 AtomicChat/ornith-35b-MLX-6bit

      显存
      暂无估算
      查看详情
      查看运行方式
      mlx_lm.generate --model AtomicChat/ornith-35b-MLX-6bit --prompt 'Hello'
      为何暂无估算
      已有格式线索,但估算映射未支持,无法估算显存
      许可证
      MIT
      上下文
      256K
      国内可达
      需代理
    • 0.8B韩英图像字幕与对话,LoRA适配低内存设备

      参数量
      0.8B
      商用
      可商用

      当前运行配置 neureps/warmly-qwen35-08b-enko-gguf

      显存
      暂无估算
      查看详情
      查看运行方式
      ollama run hf.co/neureps/warmly-qwen35-08b-enko-gguf
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      国内可达
      需代理
    • 语音恢复:劣化音频→44.1kHz近棚音,用于数据集清洗

      参数量
      166.6M
      商用
      可商用

      当前运行配置 nineninesix/diamond-1.0

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      国内可达
      需代理
    • 2-bit 量化 MLX 模型,专为 Apple Silicon 推理

      参数量
      20B (MoE)
      商用
      需自查

      当前运行配置 majentik/gpt-oss-20b-TurboQuant-MLX-2bit

      显存
      暂无估算
      查看详情
      查看运行方式
      mlx_lm.generate --model majentik/gpt-oss-20b-TurboQuant-MLX-2bit --prompt '你的提示'
      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      Apache 2.0
      国内可达
      需代理
    • 多语言文本嵌入,NVFP4 量化,专为 RAG 和检索设计

      参数量
      1.14B
      商用
      需自查

      当前运行配置 nvidia/Nemotron-3-Embed-1B-NVFP4

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve nvidia/Nemotron-3-Embed-1B-NVFP4
      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      OpenMDW-1.1
      上下文
      32k
      国内可达
      需代理
    • 面向硬件音乐设备的本地助手,基于Qwen3-4B微调

      参数量
      4B
      商用
      不可商用

      当前运行配置 zak-raindog/gear-manual-qwen3-4b

      显存
      ~2.4GB 4-bit(估算)
      查看详情
      查看运行方式
      mlx_lm.generate --model zak-raindog/gear-manual-qwen3-4b --prompt "如何使用EP-133?"
      许可证
      cc-by-nc-4.0
      国内可达
      需代理
    • 多语言文本嵌入模型,面向RAG检索与语义搜索。

      参数量
      8B
      商用
      需自查

      当前运行配置 nvidia/Nemotron-3-Embed-8B-BF16

      显存
      ~17GB BF16(估算)
      查看详情
      查看运行方式
      vllm serve nvidia/Nemotron-3-Embed-8B-BF16
      许可证
      OpenMDW-1.1
      上下文
      32768
      国内可达
      需代理
    • 多阶段微调的27B视觉模型,提升推理与创意写作

      参数量
      27B
      商用
      需自查

      当前运行配置 DavidAU/Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF

      显存
      ~57GB BF16(估算)
      查看详情
      查看运行方式
      ollama run hf.co/DavidAU/Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF
      许可证
      Apache 2.0
      上下文
      256k
      国内可达
      需代理
    • 无审查视觉 MoE 模型,Hermes 工具调用,GGUF 本地推理

      参数量
      35B (3B 激活)
      商用
      可商用

      当前运行配置 LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF --jinja
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      262K (可扩展至 1M)
      国内可达
      需代理
    • 70+语言语音识别,关注俄语、哈萨克语等小语种

      参数量
      220M / 600M
      商用
      可商用

      当前运行配置 ai-sage/GigaAM-Multilingual

      显存
      暂无估算
      查看详情
      查看运行方式
      python -c "from transformers import AutoModel; model=AutoModel.from_pretrained('ai-sage/GigaAM-Multilingual', revision='ctc', trust_remote_code=True); print(model.transcribe('example.wav'))"
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      mit
      国内可达
      需代理
      其它形态
      原生 · MLX
    • Apple Silicon 本地离线俄哈吉乌语 ASR,MLX 量化

      参数量
      224M
      商用
      可商用

      当前运行配置 ai-babai/gigaam-multilingual-mlx-int8-g64

      显存
      ~0.2GB 8-bit(估算)
      查看详情
      查看运行方式
      uvx gigaam-multilingual-mlx gigaam-stt <audio> --variant int8
      许可证
      MIT
      国内可达
      需代理
    • 俄语及中亚语言离线语音转录,Apple Silicon 用

      参数量
      161M
      商用
      可商用

      当前运行配置 ai-babai/gigaam-multilingual-mlx-int4-g64

      显存
      ~0.1GB 4-bit(估算)
      查看详情
      查看运行方式
      uv tool install gigaam-multilingual-mlx==0.2.0 && gigaam-stt audio.wav --variant int4
      许可证
      MIT
      上下文
      不适用
      国内可达
      需代理
    • 多语言文本嵌入模型,用于语义搜索与 RAG

      参数量
      1.14B
      商用
      需自查

      当前运行配置 nvidia/Nemotron-3-Embed-1B-BF16

      显存
      ~2.4GB BF16(估算)
      查看详情
      查看运行方式
      vllm serve nvidia/Nemotron-3-Embed-1B-BF16
      许可证
      OpenMDW-1.1
      上下文
      32768
      国内可达
      需代理
    • Qwen3.6 MoE 量化版,Apple Metal 加速推理

      参数量
      35B (3B 激活)
      商用
      可商用

      当前运行配置 andreaborio/Qwen3.6-35B-A3B-DS4-ExpertMajor-v1-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      ollama run hf.co/andreaborio/Qwen3.6-35B-A3B-DS4-ExpertMajor-v1-GGUF

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
    • 1B 工具调用思考模型 GGUF 量化,本地运行

      参数量
      1B
      商用
      可商用

      当前运行配置 GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-V2-Thinking-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      ollama run hf.co/GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-V2-Thinking-GGUF

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      128k
      国内可达
      需代理
    • 1-bit 27B 模型, 可在手机和笔记本本地运行推理

      参数量
      27B
      商用
      可商用

      当前运行配置 prism-ml/Bonsai-27B-mlx-1bit

      显存
      ~4.1GB 1-bit(估算)
      查看详情
      查看运行方式
      mlx_lm.generate --model prism-ml/Bonsai-27B-mlx-1bit
      许可证
      apache-2.0
      上下文
      262K
      国内可达
      需代理
    • 网络安全领域8B微调模型, 本地离线运行红蓝队工具

      参数量
      8B
      商用
      限制商用

      当前运行配置 RavichandranJ/Dolphin3-Cyber-8B-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      ollama run hf.co/RavichandranJ/Dolphin3-Cyber-8B-GGUF
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      llama3.1
      上下文
      2k
      国内可达
      需代理
    • GGUF 量化,解禁角色扮演与图像描述

      参数量
      4B
      商用
      可商用

      当前运行配置 fattis/FrickFritz-4B-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      ollama run hf.co/fattis/FrickFritz-4B-GGUF
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
    • 多语言翻译 MoE 模型的 APEX 量化版,供本地 GGUF 推理

      参数量
      30B (3B 激活)
      商用
      可商用

      当前运行配置 alphaZimuth/Hy-MT2-30B-A3B-APEX-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      ollama run hf.co/alphaZimuth/Hy-MT2-30B-A3B-APEX-GGUF
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      国内可达
      需代理
    • 腾讯 Hy3 混合精度 GGUF,针对本地受限硬件极限压缩

      商用
      可商用

      当前运行配置 AngelSlim/Hy3-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      ollama run hf.co/AngelSlim/Hy3-GGUF
      为何暂无估算
      缺少可用的参数量依据,无法估算显存
      许可证
      apache-2.0
      上下文
      65536
      国内可达
      魔搭可用
    • 1B 思考模型,改进编码与指令遵循,适合本地部署

      参数量
      1B
      商用
      可商用

      当前运行配置 GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking

      显存
      暂无估算
      查看详情
      查看运行方式
      ollama run hf.co/GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      128k
      国内可达
      需代理
      其它形态
      原生 · GGUF
    • 未审查文本生成模型,卡信息缺失

      参数量
      5B
      商用
      需自查

      当前运行配置 Kutches/UncensoredV2

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve Kutches/UncensoredV2
      为何暂无估算
      权重格式未知,无法估算显存
      国内可达
      需代理
    • Wings of Fire 世界观角色扮演, 支持链式思维

      参数量
      31B
      商用
      可商用

      当前运行配置 Darkhn-Quants-4/Gemma-4-31B-Animus-V15.0-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      ollama run hf.co/Darkhn-Quants-4/Gemma-4-31B-Animus-V15.0-GGUF
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      国内可达
      需代理
    • 4bit MoE本地运行于Apple Silicon

      参数量
      30B (3B 激活)
      商用
      需自查

      当前运行配置 mlx-community/NVIDIA-Nemotron-3-Nano-30B-A3B-OptiQ-4bit

      显存
      暂无估算
      查看详情
      查看运行方式
      mlx_lm.generate --model mlx-community/NVIDIA-Nemotron-3-Nano-30B-A3B-OptiQ-4bit
      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      nvidia-open-model-license
      国内可达
      需代理
    • 4-bit MLX 量化,Apple Silicon 本地运行文本生成

      参数量
      35B (3B 激活)
      商用
      可商用

      当前运行配置 mlx-community/Qwen3.5-35B-A3B-OptiQ-4bit

      显存
      暂无估算
      查看详情
      查看运行方式
      mlx_lm.generate --model mlx-community/Qwen3.5-35B-A3B-OptiQ-4bit --prompt 'Explain quantum computing.' --max-tokens 200
      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      apache-2.0
      上下文
      128k
      国内可达
      需代理
    • 三元2-bit 27B开源模型,笔记本本地运行推理

      参数量
      27B
      商用
      可商用

      当前运行配置 prism-ml/Ternary-Bonsai-27B-mlx-2bit

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf prism-ml/Ternary-Bonsai-27B-gguf
      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      apache-2.0
      上下文
      262k
      国内可达
      需代理
    • 三元权重 27B 推理模型,笔记本本地运行

      参数量
      27B
      商用
      可商用

      当前运行配置 prism-ml/Ternary-Bonsai-27B-gguf

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      ollama run hf.co/prism-ml/Ternary-Bonsai-27B-gguf

      其它 1 种运行方式见详情页

      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      Apache-2.0
      上下文
      262K
      国内可达
      需代理
    • MLX VQ量化35B MoE,适合Apple Silicon本地推理

      参数量
      35B (3B激活)
      商用
      可商用

      当前运行配置 aquaman164/Qwen3.6-35B-A3B-MLX-VQ-2.6bpw

      显存
      暂无估算
      查看详情
      查看运行方式
      huggingface-cli download aquaman164/Qwen3.6-35B-A3B-MLX-VQ-2.6bpw --local-dir qwen-vq && python qwen-vq/code/vq_serve.py --model qwen-vq
      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      Apache-2.0
      上下文
      128k
      国内可达
      需代理
    • Krea-2 Turbo 风格化 LoRA,电影感氛围增强

      商用
      可商用

      当前运行配置 mgwr/M87

      显存
      暂无估算
      查看详情
      查看运行方式
      python -c "from diffusers import DiffusionPipeline; pipe = DiffusionPipeline.from_pretrained('krea/Krea-2-Turbo'); pipe.load_lora_weights('mgwr/M87'); pipe('a cat --preview').images[0].save('out.png')"
      为何暂无估算
      缺少可用的显存依据
      许可证
      apache-2.0
      国内可达
      需代理
    • Apple Silicon 上 Claude-Code 式本地编码代理

      参数量
      35B (3B 活跃)
      商用
      需自查

      当前运行配置 nathansutton/Ornith-1.0-35B-UD-Q2_K_XL-MLX

      显存
      ~12GB 2-bit(估算)
      查看详情
      查看运行方式
      uvx --from git+https://github.com/nathansutton/mlxcc chad
      国内可达
      需代理
    • Apple Silicon 本地 4-bit 混合精度量化文本生成模型

      参数量
      9B
      商用
      可商用

      当前运行配置 mlx-community/Qwen3.5-9B-OptiQ-4bit

      显存
      暂无估算
      查看详情
      查看运行方式
      mlx_lm.generate --model mlx-community/Qwen3.5-9B-OptiQ-4bit
      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      apache-2.0
      上下文
      128k
      国内可达
      需代理
    • 修复循环生成并保留1M上下文推理能力的研究型模型

      参数量
      9B
      商用
      可商用

      当前运行配置 empero-ai/Qwythos-9B-v2

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve empero-ai/Qwythos-9B-v2 --trust-remote-code
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      1048k
      国内可达
      需代理
      其它形态
      原生 · GGUF
    • 风格参考 LoRA,将参考图风格注入 Krea2 Turbo 生成

      商用
      需自查

      当前运行配置 ostris/krea2_turbo_style_reference

      显存
      暂无估算
      查看详情
      查看运行方式
      pipe = DiffusionPipeline.from_pretrained("krea/Krea-2-Turbo", custom_pipeline="ostris/Krea2OstrisEdit", torch_dtype=torch.bfloat16); pipe.enable_model_cpu_offload(); pipe.load_lora_weights("ostris/krea2_turbo_style_reference")
      为何暂无估算
      缺少可用的显存依据
      许可证
      krea-2-community-license
      上下文
      不适用
      国内可达
      需代理
    • 统一音频-文本语言模型,支持语音识别、翻译、TTS 与音频生成

      参数量
      2B
      商用
      需自查

      当前运行配置 nvidia/Nemotron-Labs-Audex-2B

      显存
      暂无估算
      查看详情
      查看运行方式
      python -c "from transformers import AutoModel; AutoModel.from_pretrained('nvidia/Nemotron-Labs-Audex-2B', trust_remote_code=True)"
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      NVIDIA OneWay Noncommercial License
      上下文
      128k
      国内可达
      需代理
    • 阿拉伯语自动语音识别 (ASR) 模型

      参数量
      2.1B
      商用
      需自查

      当前运行配置 CohereLabs/cohere-transcribe-arabic-07-2026

      显存
      暂无估算
      查看详情
      查看运行方式
      python -c "from transformers import pipeline; pipe = pipeline('automatic-speech-recognition', 'CohereLabs/cohere-transcribe-arabic-07-2026'); print(pipe('audio.wav'))"
      为何暂无估算
      权重格式未知,无法估算显存
      国内可达
      需代理
    • 流式自回归 TTS,面向实时对话与语音代理

      参数量
      555M
      商用
      需自查

      当前运行配置 nineninesix/gepard-1.0

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve nineninesix/gepard-1.0
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache 2.0 (codec: NVIDIA Open Model License)
      语言
      英语(美/英) · 西班牙语(墨) · 葡萄牙语(巴西) · 荷兰语
      国内可达
      需代理
    • Claude Opus推理蒸馏并反审查的27B模型GGUF版

      参数量
      27B
      商用
      可商用

      当前运行配置 fzcfweasdferttgg/Qwen3.6-27B-Claude-Opus-Reasoning-Distill-v2-heretic-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      ollama run hf.co/fzcfweasdferttgg/Qwen3.6-27B-Claude-Opus-Reasoning-Distill-v2-heretic-GGUF
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      256K
      国内可达
      需代理
    • 视觉语言模型,思考令牌减半,GGUF量化,适合本地运行

      参数量
      27B
      商用
      需自查

      当前运行配置 bottlecapai/ThinkingCap-Qwen3.6-27B-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf bottlecapai/ThinkingCap-Qwen3.6-27B-GGUF:Q4_K_M --mmproj bottlecapai/ThinkingCap-Qwen3.6-27B-GGUF:mmproj-ThinkingCap-Qwen3.6-27B-f16.gguf
      为何暂无估算
      权重格式未知,无法估算显存
      国内可达
      需代理
    • 82M 参数轻量 TTS 模型,支持多语言,可本地部署

      参数量
      82M
      商用
      可商用

      当前运行配置 hexgrad/Kokoro-82M

      显存
      暂无估算
      查看详情
      查看运行方式
      pip install kokoro && python -c "from kokoro import KPipeline; KPipeline('a'); print('Kokoro loaded')"
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      语言
      8 种语言
      国内可达
      需代理
    • 面向高吞吐推理的压缩 MoE 模型,用于交互式推理与高并发部署

      参数量
      75B (9.3B active)
      商用
      需自查

      当前运行配置 nvidia/NVIDIA-Nemotron-Labs-3-Puzzle-75B-A9B-NVFP4

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve nvidia/NVIDIA-Nemotron-Labs-3-Puzzle-75B-A9B-NVFP4 --trust-remote-code --mamba-backend flashinfer
      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      OpenMDW-1.1
      上下文
      1M
      国内可达
      需代理
    • 音频-文本统一LLM,兼顾文本推理与语音/音频生成

      参数量
      30B MoE (3B激活)
      商用
      需自查

      当前运行配置 nvidia/Nemotron-Labs-Audex-30B-A3B

      显存
      暂无估算
      查看详情
      查看运行方式
      python -c "from transformers import AutoModelForCausalLM; AutoModelForCausalLM.from_pretrained('nvidia/Nemotron-Labs-Audex-30B-A3B', trust_remote_code=True)"
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      NVIDIA Oneway Noncommercial License
      上下文
      1M
      国内可达
      需代理
    • 51M 参数边缘路由器, 判断提示词复杂度并分发至本地或云端模型

      参数量
      51M
      商用
      需自查

      当前运行配置 SupraLabs/Supra-Router-51M

      显存
      暂无估算
      查看详情
      查看运行方式
      AutoModelForCausalLM.from_pretrained('SupraLabs/Supra-Router-51M')
      为何暂无估算
      权重格式未知,无法估算显存
      上下文
      3840
      国内可达
      需代理
    • LTX-2.3 身份保持 LoRA,单参考图加提示生成人物视频

      参数量
      22B (基模型)
      商用
      需自查

      当前运行配置 Alissonerdx/LTX-Best-Face-ID

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      other
      国内可达
      需代理
    • 紧凑推理微调,减少冗余推理轨迹,降低推理token消耗

      参数量
      12B
      商用
      需自查

      当前运行配置 kai-os/Grug-12B

      显存
      暂无估算
      查看详情
      查看运行方式
      ollama run hf.co/kai-os/Grug-12B
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      other
      国内可达
      需代理
    • 35B MoE 视觉 Agent,用于长程搜索与工具调用

      参数量
      35B MoE
      商用
      需自查

      当前运行配置 InternScience/Agents-A1

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      vllm serve InternScience/Agents-A1 --port 8000 --tensor-parallel-size 1 --max-model-len 262144 --reasoning-parser qwen3

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache 2.0
      上下文
      262k
      国内可达
      魔搭可用
      其它形态
      原生 · GGUF
    • 深度条件图像生成,保持输入图像3D结构,用于风格迁移与内容变换

      参数量
      862MB LoRA
      商用
      需自查

      当前运行配置 Patil/Krea-2-depth-controlnet

      显存
      暂无估算
      查看详情
      查看运行方式
      git clone https://github.com/Tanmaypatil123/Krea-2-controlnet && cd Krea-2-controlnet && pip install -q -r requirements.txt && hf download Patil/Krea-2-depth-controlnet depth-control-lora.safetensors --local-dir . && python inference.py input.jpg -p "prompt" --lora depth-control-lora.safetensors
      为何暂无估算
      缺少可用的显存依据
      许可证
      krea-2-community-license
      国内可达
      需代理
    • 无审查 Qwen3.5-9B 微调,用于网络安全与生物医学

      参数量
      9B
      商用
      可商用

      当前运行配置 MaralGPT/MaralGPT-Mythos-9B-2606-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      ollama run hf.co/MaralGPT/MaralGPT-Mythos-9B-2606-GGUF
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      1M
      国内可达
      需代理
    • 1.3B MoD对话模型,支持ChatML与代码/数学生成

      参数量
      1.27B
      商用
      可商用

      当前运行配置 Smilyai-labs/Nova-1-Standard-1.3B-Preview

      显存
      暂无估算
      查看详情
      查看运行方式
      pipeline('text-generation', model='Smilyai-labs/Nova-1-Standard-1.3B-Preview', trust_remote_code=True, device_map='auto')
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      2048
      国内可达
      需代理
    • 三元专家量化版,9.4 GB 全量跑在 16 GB Mac 上

      参数量
      35B (3B 激活)
      商用
      可商用

      当前运行配置 manjunathshiva/Qwen3.6-35B-A3B-tq3a-tqTe-g64

      显存
      暂无估算
      查看详情
      查看运行方式
      pip install 'turboquant-mlx-full>=0.12.3' && python -m turboquant_mlx.generate --model manjunathshiva/Qwen3.6-35B-A3B-tq3a-tqTe-g64
      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      Apache-2.0
      国内可达
      需代理
    • 用途未公开

      商用
      需自查

      当前运行配置 programasweights/paw-programs

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      缺少可用的参数量依据,无法估算显存
      国内可达
      需代理
    • 编程与工具调用代理微调,供开发者本地使用

      参数量
      12B
      商用
      可商用

      当前运行配置 yuxinlu1/gemma-4-12B-agentic-fable5-composer2.5-v2-3.5x-tau2

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf yuxinlu1/gemma-4-12B-agentic-fable5-composer2.5-v2-3.5x-tau2-GGUF -ngl 99 --jinja
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      16k(示例命令)
      国内可达
      需代理
      其它形态
      原生 · GGUF
    • MLX 8-bit 量化英文创意写作模型,适合故事小说生成

      参数量
      31B
      商用
      可商用

      当前运行配置 ailexleon/Gemma4-Gutenberg-31B-Heretic-mlx-8Bit

      显存
      ~34GB 8-bit(估算)
      查看详情
      查看运行方式
      mlx_lm.generate --model ailexleon/Gemma4-Gutenberg-31B-Heretic-mlx-8Bit --prompt 'hello'
      许可证
      apache-2.0
      国内可达
      需代理
    • 为Flux.2 Klein 9B图像指定阳光方向,球体参考工作流

      参数量
      9B
      商用
      可商用

      当前运行配置 eric-venti-seeds/Sun-Direction-Lora-Flux2Klein9B

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      不适用
      国内可达
      需代理
    • 对话式语音合成,100+语种,零样本克隆与内联控制

      参数量
      4B
      商用
      需自查

      当前运行配置 bosonai/higgs-tts-3-4b

      显存
      暂无估算
      查看详情
      查看运行方式(还有 2 种)
      sgl-omni serve --model-path bosonai/higgs-tts-3-4b --port 8000

      其它 2 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      boson-higgs-audio-v3-research-and-non-commercial-license
      上下文
      8192
      语言
      100+ 语种 (含中/英/日/韩/阿拉伯等85种<5% WER)
      国内可达
      需代理
    • 无审查Gemma4-26B MoE,适用于代理编码与创意写作

      参数量
      26B-A4B
      商用
      限制商用

      当前运行配置 HauhauCS/Gemma4-26B-A4B-QAT-Uncensored-HauhauCS-Balanced-MTP

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -m Gemma4-26B-A4B-QAT-Uncensored-HauhauCS-Balanced-Q4_K_M.gguf --mmproj mmproj-Gemma4-26B-A4B-QAT-Uncensored-HauhauCS-Balanced-BF16.gguf -md mtp-gemma-4-26B-A4B-it.gguf --spec-type draft-mtp -ngl 99 -fa on (需下载3个文件)
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      gemma
      上下文
      256k
      国内可达
      需代理
    • 移除安全过滤的GLM-5.2 GGUF,供研究实验用

      商用
      可商用

      当前运行配置 huihui-ai/Huihui-GLM-5.2-abliterated-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      llama-server -m ./glm52/GLM-5.2-UD-IQ1_M.gguf -c 4096(需编译llama.cpp)

      其它 1 种运行方式见详情页

      为何暂无估算
      缺少可用的参数量依据,无法估算显存
      许可证
      MIT
      国内可达
      需代理
    • 未审查 1M 上下文 Qwen3.5 微调,支持工具调用

      参数量
      9B
      商用
      可商用

      当前运行配置 huihui-ai/Huihui-Qwythos-9B-Claude-Mythos-5-1M-abliterated-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-cli -hf huihui-ai/Huihui-Qwythos-9B-Claude-Mythos-5-1M-abliterated-GGUF --model Huihui-Qwythos-9B-Claude-Mythos-5-1M-abliterated-Q4_K.gguf -ngl 99 -c 262144 -fa on -np 1 --spec-type draft-mtp --spec-draft-n-max 2
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      1M
      国内可达
      需代理
    • 双塔扩散LLM,块并行解码,2.42x生成吞吐量

      参数量
      30B (3B 激活)
      商用
      需自查

      当前运行配置 nvidia/Nemotron-Labs-TwoTower-30B-A3B-Base-BF16

      显存
      ~63GB BF16(估算)
      查看详情
      查看运行方式(还有 1 种)
      python3 -c "from transformers import AutoModelForCausalLM; AutoModelForCausalLM.from_pretrained('nvidia/Nemotron-Labs-TwoTower-30B-A3B-Base-BF16',trust_remote_code=True,torch_dtype='bfloat16').cuda()" (单GPU AR模式,约59GB显存)

      其它 1 种运行方式见详情页

      许可证
      NVIDIA Nemotron Open Model License
      上下文
      128k
      国内可达
      需代理
    • Qwen3.6-27B NVFP4 量化,面向 vLLM 部署与推理

      参数量
      27B
      商用
      可商用

      当前运行配置 nvidia/Qwen3.6-27B-NVFP4

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve nvidia/Qwen3.6-27B-NVFP4 --port 8000 --quantization modelopt --max-model-len 262144 --reasoning-parser qwen3
      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      Apache-2.0
      上下文
      262k
      国内可达
      需代理
    • 12B 文本到图像扩散模型,GGUF 量化版,用于本地生成

      参数量
      12B
      商用
      需自查

      当前运行配置 krea/Krea-2-Turbo

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      sglang generate --model-path krea/Krea-2-Turbo --prompt "a red fox sitting in fresh snow, golden hour, photorealistic" --num-inference-steps 8 --height 1024 --width 1024 --save-output

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Krea-2-Community-License
      国内可达
      需代理
      其它形态
      原生 · GGUF
    • 8B参数1B激活MoE,消费级GPU可运行的APEX量化

      参数量
      8B (激活1B)
      商用
      需自查

      当前运行配置 mudler/LFM2.5-8B-A1B-APEX-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      llama-server -hf mudler/LFM2.5-8B-A1B-APEX-GGUF:LFM2.5-8B-A1B-APEX-I-Balanced.gguf

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      LFM1.0
      国内可达
      需代理
    • 关闭思考的编码代理模型,降低 token 延迟,适合本地工作流

      参数量
      35B (3B 激活)
      商用
      可商用

      当前运行配置 Jackrong/Qwopus3.6-35B-A3B-Coder-MTP-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      llama-server -hf Jackrong/Qwopus3.6-35B-A3B-Coder-MTP-GGUF -m qwopus-35b-a3b-coder-q5_k_m.gguf

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      国内可达
      需代理
    • 生成漏洞利用与安全工具,面向攻防研究者

      参数量
      27B
      商用
      可商用

      当前运行配置 BugTraceAI/BugTraceAI-CORE-Ultra-27B-Q6

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      python -c "from llama_cpp import Llama; Llama.from_pretrained(repo_id='BugTraceAI/BugTraceAI-CORE-Ultra-27B-Q4', filename='BugTraceAI-CORE-Ultra-SFT-Q6_K.gguf')"

      其它 1 种运行方式见详情页

      为何暂无估算
      已有格式线索,但估算映射未支持,无法估算显存
      许可证
      Apache-2.0
      上下文
      4096
      国内可达
      需代理
    • Gemma 4 12B/3B GGUF 量化集合,供本地聊天与代码任务

      参数量
      12B (以及 3B)
      商用
      需自查

      当前运行配置 rahul7star/gemma-gguf

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      llama-cli -hf rahul7star/gemma-gguf -m model-i-gemma-e4-12b-quality.gguf

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      上下文
      262k
      国内可达
      需代理
    • 3B 视觉语言 OCR 模型,文档解析与 Markdown 转换

      参数量
      3B
      商用
      可商用

      当前运行配置 sahilchachra/Unlimited-OCR-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      huggingface-cli download sahilchachra/Unlimited-OCR-GGUF --include Unlimited-OCR-Q4_K_M.gguf mmproj-Unlimited-OCR-F16.gguf --local-dir ./uocr
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MIT
      国内可达
      需代理
    • 混合架构边缘设备模型,用于设备端文本生成

      参数量
      230M
      商用
      需自查

      当前运行配置 LiquidAI/LFM2.5-230M

      显存
      暂无估算
      查看详情
      查看运行方式(还有 2 种)
      llama-server -hf LiquidAI/LFM2.5-230M-GGUF

      其它 2 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      LFM1.0
      上下文
      32768
      国内可达
      需代理
      其它形态
      原生 · GGUF
    • 语言世界模型,模拟7类agent交互环境

      参数量
      35B (3B激活)
      商用
      可商用

      当前运行配置 Qwen/Qwen-AgentWorld-35B-A3B

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      vllm serve Qwen/Qwen-AgentWorld-35B-A3B --port 8000 --tensor-parallel-size 4 --max-model-len 262144 --reasoning-parser qwen3 --trust-remote-code

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      262k
      国内可达
      魔搭可用
      其它形态
      原生 · GGUF
    • IQ2_M 31B 多模态 Agent,10 GiB 本地运行

      参数量
      31B
      商用
      限制商用

      当前运行配置 pearsonkyle/gemma-4-31b-imatrix-GGUF

      显存
      ~11GB 2-bit(估算)
      查看详情
      查看运行方式(还有 1 种)
      ollama run hf.co/pearsonkyle/gemma-4-31b-imatrix-GGUF:IQ2_M

      其它 1 种运行方式见详情页

      许可证
      gemma
      国内可达
      需代理
    • 3B无审查推理模型,专注数学与竞赛编程

      参数量
      3B
      商用
      可商用

      当前运行配置 squ11z1/Mythos-nano

      显存
      暂无估算
      查看详情
      查看运行方式(还有 3 种)
      ollama run hf.co/squ11z1/Mythos-nano

      其它 3 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MIT
      国内可达
      需代理
    • 无审查的27B视觉语言模型,用于多模态对话与图像理解

      参数量
      27B
      商用
      可商用

      当前运行配置 mradermacher/Qwen3.6-27B-AEON-Ultimate-Uncensored-BF16-i1-GGUF

      显存
      ~57GB BF16(估算)
      查看详情
      查看运行方式(还有 1 种)
      ollama run hf.co/mradermacher/Qwen3.6-27B-AEON-Ultimate-Uncensored-BF16-GGUF:Q4_K_M

      其它 1 种运行方式见详情页

      许可证
      apache-2.0
      国内可达
      需代理
    • 27B 无审查多模态混合模型,本地创作者使用

      参数量
      27B
      商用
      可商用

      当前运行配置 mradermacher/Qwen3.6-27B-AEON-Ultimate-Uncensored-BF16-GGUF

      显存
      ~57GB BF16(估算)
      查看详情
      查看运行方式(还有 1 种)
      llama-server -hf mradermacher/Qwen3.6-27B-AEON-Ultimate-Uncensored-BF16-GGUF

      其它 1 种运行方式见详情页

      许可证
      apache-2.0
      国内可达
      需代理
    • Krea 2 Turbo 的 FP8 量化版,16GB 显存可用

      商用
      需自查

      当前运行配置 AlperKTS/Krea2_FP8

      显存
      暂无估算
      查看详情
      查看运行方式
      huggingface-cli download AlperKTS/Krea2_FP8 --local-dir ./krea2_fp8
      为何暂无估算
      缺少可用的显存依据
      许可证
      krea-2-license
      国内可达
      需代理
    • 轻量推理模型,专注数学与代码任务的本地运行

      商用
      可商用

      当前运行配置 mradermacher/Mythos-nano-i1-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      from llama_cpp import Llama; llm = Llama.from_pretrained(repo_id='mradermacher/Mythos-nano-i1-GGUF', filename='Mythos-nano.i1-Q4_K_M.gguf')

      其它 1 种运行方式见详情页

      为何暂无估算
      缺少可用的参数量依据,无法估算显存
      许可证
      MIT
      国内可达
      需代理
    • 解除审查的Gemma4多模态模型,面向代理编码与创意写作

      参数量
      12B
      商用
      限制商用

      当前运行配置 HauhauCS/Gemma4-12B-QAT-Uncensored-HauhauCS-Balanced

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -m Gemma4-12B-QAT-Uncensored-HauhauCS-Balanced-Q4_K_M.gguf -md mtp-gemma-4-12B-it.gguf --spec-type draft-mtp --mmproj mmproj-Gemma4-12B-QAT-Uncensored-HauhauCS-Balanced-BF16.gguf -ngl 99 -fa on (需先下载gguf及mmproj文件)
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      gemma
      上下文
      256K
      国内可达
      需代理
    • 12B 图像生成基座,用于 LoRA 微调训练

      参数量
      12B
      商用
      需自查

      当前运行配置 krea/Krea-2-Raw

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      pip install git+https://github.com/sgl-project/sglang.git && sglang generate --model-path krea/Krea-2-Raw --prompt "a fox in the snow" --num-inference-steps 52 --height 1024 --width 1024 --guidance-scale 3.5 --save-output

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      krea-2-community-license
      国内可达
      需代理
    • 零样本声音克隆多语言TTS模型,支持31种语言和本地部署

      参数量
      4.6B
      商用
      可商用

      当前运行配置 OpenMOSS-Team/MOSS-TTS-Local-Transformer-v1.5

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      python -c "from transformers import AutoModel; model = AutoModel.from_pretrained('OpenMOSS-Team/MOSS-TTS-Local-Transformer-v1.5', trust_remote_code=True)"

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      语言
      31种语言 (含中·粤·英·日·韩·法·德·西等)
      国内可达
      魔搭可用
    • Qwen3.6-27B的LoRA微调,用于故事与寓言生成

      参数量
      27B (基座) + LoRA
      商用
      需自查

      当前运行配置 hotdogs/qwen3.6-27b-fable5-lora

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve Qwen/Qwen3.6-27B --enable-lora --lora-modules fable=hotdogs/qwen3.6-27b-fable5-lora
      为何暂无估算
      权重格式未知,无法估算显存
      国内可达
      需代理
    • 27B编码器GGUF,兼容多种工具历史格式,供本地开发者使用

      参数量
      27B
      商用
      可商用

      当前运行配置 Jackrong/Qwopus3.6-27B-Coder-Compat-MTP-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf Jackrong/Qwopus3.6-27B-Coder-Compat-MTP-GGUF (需代理下载)
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      32K
      国内可达
      需代理
    • 为编码代理提供仓库探索与精确文件引用

      参数量
      4B
      商用
      可商用

      当前运行配置 microsoft/FastContext-1.0-4B-RL

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      python3 -m sglang.launch_server --model-path microsoft/FastContext-1.0-4B-RL --tool-call-parser qwen --context-length 262144 --trust-remote-code --dtype bfloat16 --host 0.0.0.0 --port 30000 --tp-size 1 --mem-fraction-static 0.8

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MIT
      上下文
      262k
      国内可达
      需代理
    • 未审查版 Gemma 代码模型,用于编程与推理,已去除拒答

      参数量
      12B
      商用
      可商用

      当前运行配置 huihui-ai/Huihui-gemma-4-12B-coder-fable5-composer2.5-v1-abliterated

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      vllm serve huihui-ai/Huihui-gemma-4-12B-coder-fable5-composer2.5-v1-abliterated

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
    • Qwen3.6-35b 全量微调,强化结构化推理与代码助手

      参数量
      35B
      商用
      可商用

      当前运行配置 Mia-AiLab/Qwable-3.6-35b

      显存
      暂无估算
      查看详情
      查看运行方式
      from transformers import AutoTokenizer, Qwen3_5ForConditionalGeneration; model = Qwen3_5ForConditionalGeneration.from_pretrained('Mia-AiLab/Qwable-3.6-35b', device_map='auto', torch_dtype='bfloat16')
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MIT
      国内可达
      需代理
    • 开源 9B 推理模型,不审查,支持 1M 上下文和函数调用

      参数量
      9B
      商用
      需自查

      当前运行配置 empero-ai/Qwythos-9B-Claude-Mythos-5-1M

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      vllm serve empero-ai/Qwythos-9B-Claude-Mythos-5-1M --max-model-len 1010000

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache 2.0
      上下文
      1M
      国内可达
      需代理
      其它形态
      原生 · GGUF
    • Ideogram 4 加速 LoRA,2 步出图,无需 CFG

      参数量
      未公开(LoRA)
      商用
      需自查

      当前运行配置 ostris/ideogram_4_turbotime_lora

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      from diffusers import DiffusionPipeline; pipe = DiffusionPipeline.from_pretrained('ideogram-ai/ideogram-4-fp8', dtype=torch.bfloat16, device_map='cuda'); pipe.load_lora_weights('ostris/ideogram_4_turbotime_lora')

      其它 1 种运行方式见详情页

      为何暂无估算
      缺少可用的显存依据
      许可证
      ideogram-4-non-commercial
      上下文
      不适用
      国内可达
      需代理
    • 284B MoE 架构,13B 激活参数,原生支持百万 Token 上下文,高效推理与强训练基线。

      参数量
      158.1B
      商用
      可商用

      当前运行配置 deepseek-ai/DeepSeek-V4-Flash

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      mit
      国内可达
      魔搭可用
    • 1.6T参数MoE旗舰,原生百万token上下文,开源模型新标杆。

      参数量
      861.6B
      商用
      可商用

      当前运行配置 deepseek-ai/DeepSeek-V4-Pro

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      mit
      国内可达
      魔搭可用
    • 混合量化Gemma-4-12B,8GB显存Pascal GPU代码生成

      参数量
      12B
      商用
      可商用

      当前运行配置 wepiqx/gemma-4-12B-it-SHQ6-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      llama-server -hf wepiqx/gemma-4-12B-it-SHQ6-GGUF:gemma-4-12b-it-SHQ6-IQ4_XS.gguf --jinja --flash-attn on -c 55555 -ngl 99

      其它 1 种运行方式见详情页

      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      Apache-2.0
      国内可达
      需代理
    • 超小型英文TTS,总4.63M参数,适合本地/嵌入式实验

      参数量
      4.63M
      商用
      可商用

      当前运行配置 owensong/Inflect-Nano-v1

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      git clone https://huggingface.co/owensong/Inflect-Nano-v1 && cd Inflect-Nano-v1 && pip install -r requirements.txt && python inference.py --text 'Hello, world.' --out output.wav

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      语言
      英文
      国内可达
      需代理
    • 万亿参数 MoE 编码智能体,长周期复杂任务更省 token、工具调用更强

      参数量
      1.1T
      商用
      需自查

      当前运行配置 moonshotai/Kimi-K2.7-Code

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      other
      国内可达
      魔搭可用
    • 云端旗舰,225B 参数稀疏 MoE,专为智能体编程和长周期任务设计

      参数量
      225.8B
      商用
      可商用

      当前运行配置 poolside/Laguna-M.1

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
    • 原生多模态 1M 上下文 MoE 模型,融合图文与视频理解,擅长编程及智能体协作

      参数量
      427B
      商用
      需自查

      当前运行配置 MiniMaxAI/MiniMax-M3

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      other
      国内可达
      魔搭可用
    • 面向真实生产力场景的智能体模型,统一推理、工具调用与执行闭环

      参数量
      396.8B
      商用
      可商用

      当前运行配置 nex-agi/Nex-N2-Pro

      显存
      暂无估算
      查看详情
      暂无收录命令

      本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      国内可达
      魔搭可用
    • 3B活跃参数的通用Agent,自动研究/编程/推理

      参数量
      35B (3B激活)
      商用
      可商用

      当前运行配置 AlexWortega/SIQ-1-35B

      显存
      暂无估算
      查看详情
      查看运行方式(还有 2 种)
      python -m sglang.launch_server --model-path AlexWortega/SIQ-1-35B --tp 2 --context-length 131072 --reasoning-parser qwen3 --tool-call-parser qwen3 --port 8080

      其它 2 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      131k
      国内可达
      需代理
    • 11 语言 ColBERT 检索模型,专为短文本 RAG 设计

      参数量
      350M
      商用
      需自查

      当前运行配置 LiquidAI/LFM2.5-ColBERT-350M

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      llama-server -hf LiquidAI/LFM2.5-ColBERT-350M-GGUF --embeddings -ngl 99 (需先下载 GGUF 文件)

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      LFM Open License v1.0
      上下文
      32k
      国内可达
      需代理
    • 11语种双编码器,面向端侧语义检索

      参数量
      350M
      商用
      需自查

      当前运行配置 LiquidAI/LFM2.5-Embedding-350M

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      llama-server -hf LiquidAI/LFM2.5-Embedding-350M-GGUF (需安装llama.cpp)

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      lfm1.0
      上下文
      32k
      国内可达
      需代理
    • Gemma 4 31B风格微调,陈词减60%,角色扮演与创意写作。

      参数量
      31B
      商用
      可商用

      当前运行配置 Gryphe/Gemma-4-31B-StyleTune

      显存
      暂无估算
      查看详情
      查看运行方式
      python -c "from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained('Gryphe/Gemma-4-31B-StyleTune')"
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
    • 面向无思考代理编码的MTP微调版,本地GGUF推理

      参数量
      27B
      商用
      可商用

      当前运行配置 bytkim/Qwen3.6-27B-MTP-pi-tune-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式(还有 2 种)
      ollama run hf.co/bytkim/Qwen3.6-27B-MTP-pi-tune-GGUF

      其它 2 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      256k
      国内可达
      需代理
    • 面向代理编码与工具调用的27B推理模型

      参数量
      27B
      商用
      可商用

      当前运行配置 Jackrong/Qwopus3.6-27B-Coder-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf Jackrong/Qwopus3.6-27B-Coder-GGUF
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      32K
      国内可达
      需代理
      其它形态
      GGUF·jackrong · GGUF·jackrong·MTP
    • 基于 Qwen3.6 的推理与代码微调模型,面向本地部署与结构化助手

      参数量
      27B
      商用
      可商用

      当前运行配置 Mia-AiLab/Qwable-3.6-27b

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve Mia-AiLab/Qwable-3.6-27b
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MIT
      国内可达
      需代理
    • Qwen3.6基MoE代理编码模型(3B激活)

      参数量
      35B (3B 激活)
      商用
      可商用

      当前运行配置 lordx64/Qwable-v1

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      llama-cli -hf lordx64/Qwable-v1-GGUF:IQ4_XS -p "Hello"(需代理)

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      AGPL-3.0
      国内可达
      需代理
    • 面向数学/代码/STEM的可验证推理3B小模型

      参数量
      3B
      商用
      可商用

      当前运行配置 WeiboAI/VibeThinker-3B

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      vllm serve WeiboAI/VibeThinker-3B

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MIT
      上下文
      64k
      国内可达
      魔搭可用
    • 轻量仓库探索子代理,供编码代理按需调用,减少 token 消耗

      参数量
      4B
      商用
      可商用

      当前运行配置 microsoft/FastContext-1.0-4B-SFT

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      python3 -m sglang.launch_server --model-path microsoft/FastContext-1.0-4B-SFT --tool-call-parser qwen --context-length 262144 --trust-remote-code --dtype bfloat16 --host 0.0.0.0 --port 30000 --tp-size 1 --mem-fraction-static 0.8

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MIT
      上下文
      262k
      国内可达
      需代理
    • 轻量级多语言文本检测模型,48语种,服务端/边缘可用

      参数量
      15.5M
      商用
      可商用

      当前运行配置 PaddlePaddle/PP-OCRv6_medium_det_safetensors

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      python -c 'from paddleocr import TextDetection; TextDetection(model_name="PP-OCRv6_medium_det", engine="transformers").predict("image.png")' (需 paddleocr 库)

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      不适用
      国内可达
      需代理
    • 基于 Qwen3 的 14B 代码模型 GGUF 量化,本地可跑

      参数量
      14B
      商用
      可商用

      当前运行配置 mradermacher/prism-coder-14b-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      llama-server -hf mradermacher/prism-coder-14b-GGUF --model prism-coder-14b.Q4_K_M.gguf

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
    • 基于 Qwen3 的代码模型,GGUF 量化版,适合本地运行

      参数量
      14B
      商用
      可商用

      当前运行配置 mradermacher/prism-coder-14b-i1-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      llama-server --hf-repo mradermacher/prism-coder-14b-i1-GGUF --hf-file prism-coder-14b.i1-Q4_K_M.gguf

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
    • 扩散多模态文本生成,3.8B活跃参数,NVFP4量化

      参数量
      25.2B (3.8B活跃)
      商用
      可商用

      当前运行配置 nvidia/diffusiongemma-26B-A4B-it-NVFP4

      显存
      暂无估算
      查看详情
      查看运行方式
      VLLM_USE_V2_MODEL_RUNNER=1 vllm serve nvidia/diffusiongemma-26B-A4B-IT-NVFP4 --trust-remote-code --max-num-seqs 4 --attention-backend TRITON_ATTN --enable-auto-tool-choice --tool-call-parser gemma4 --reasoning-parser gemma4 --override-generation-config '{"max_new_tokens": null}' --default-chat-template-kwargs '{"enable_thinking":true}' (需H100/B100)
      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      Apache 2.0 (Gemma Terms)
      上下文
      256k
      国内可达
      需代理
    • 精准时长控制与情感表达的中文零样本TTS

      商用
      需自查

      当前运行配置 IndexTeam/IndexTTS-2

      显存
      暂无估算
      查看详情
      查看运行方式
      暂无已验证的一键部署命令,需参考官方GitHub仓库(https://github.com/index-tts/index-tts)手动安装
      为何暂无估算
      缺少可用的显存依据
      国内可达
      魔搭可用
    • 4B 提示词增强与 Z-Image 文本编码器,本地双用途

      参数量
      4B
      商用
      可商用

      当前运行配置 BennyDaBall/Z-Image-Engineer-V6

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      llama-server -hf BennyDaBall/Z-Image-Engineer-V6-GGUF

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      国内可达
      需代理
    • Qwen2 架构的阿/英指令模型 GGUF 量化

      参数量
      7B
      商用
      可商用

      当前运行配置 mradermacher/Averroes-Q-Instruct-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      ollama run hf.co/mradermacher/Averroes-Q-Instruct-GGUF

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
    • 本地 Python 编程模型,离线解决算法问题

      参数量
      12B
      商用
      可商用

      当前运行配置 yuxinlu1/gemma-4-12B-coder-fable5-composer2.5-v1-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      ollama run hf.co/yuxinlu1/gemma-4-12B-coder-fable5-composer2.5-v1-GGUF

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      gemma
      上下文
      131k
      国内可达
      需代理
    • 30B总/3B激活的MoE代码代理模型,专注代码生成与终端任务

      参数量
      30B总 / 3B激活
      商用
      可商用

      当前运行配置 CohereLabs/North-Mini-Code-1.0

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      vllm serve CohereLabs/North-Mini-Code-1.0

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      256K
      国内可达
      需代理
      其它形态
      原生 · GGUF
    • 基于 MoE 的多语言 TTS,支持零样本克隆与流式生成

      商用
      可商用

      当前运行配置 Zyphra/ZONOS2

      显存
      暂无估算
      查看详情
      查看运行方式
      git clone https://github.com/Zyphra/ZONOS2 && cd ZONOS2 && uv sync && uv run python -m minisgl --model-path Zyphra/ZONOS2 --tts-default-voices-dir ./default_voices/(需 NVIDIA GPU, Linux)
      为何暂无估算
      缺少可用的显存依据
      许可证
      apache-2.0
      语言
      英语(主)·中文(主)·日语(主) · 韩/俄/意/葡/法/西/越/德/希伯来/荷兰/瑞典等 32 语种
      国内可达
      需代理
    • Llama-3.2-3B 微调,GGUF 格式,给本地推理用户

      参数量
      3B
      商用
      需自查

      当前运行配置 SAi404/niko_constitution_gguf

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-cli -hf SAi404/niko_orchestrator_gguf --jinja
      为何暂无估算
      权重格式未知,无法估算显存
      国内可达
      需代理
    • 离散扩散文本生成,支持图像/视频输入,低延迟

      参数量
      25.2B (3.8B active)
      商用
      可商用

      当前运行配置 unsloth/diffusiongemma-26B-A4B-it-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      DiffusionGemmaForBlockDiffusion.from_pretrained("google/diffusiongemma-26B-A4B-it", device_map="auto")
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache 2.0
      上下文
      256k
      国内可达
      需代理
    • 18B MoE预览模型,面向Bittensor SN24研究蒸馏

      参数量
      18B (2B active)
      商用
      可商用

      当前运行配置 silx-ai/Quasar-Preview

      显存
      暂无估算
      查看详情
      查看运行方式
      python -c "from transformers import AutoModelForCausalLM; AutoModelForCausalLM.from_pretrained('silx-ai/Quasar-Preview', trust_remote_code=True)"
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MIT
      上下文
      5M (实验性配置)
      国内可达
      需代理
    • Delphi扩展律研究基座,25B参数,终版模型

      参数量
      25B
      商用
      可商用

      当前运行配置 marin-community/delphi-1e23-25Bparams-628Btokens

      显存
      暂无估算
      查看详情
      查看运行方式
      transformers.from_pretrained('marin-community/delphi-1e23-25Bparams-628Btokens')
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      4k
      国内可达
      需代理
    • 日英双语聊天模型,适合代理工作流与工具使用

      参数量
      1.2B
      商用
      需自查

      当前运行配置 LiquidAI/LFM2.5-1.2B-JP-202606

      显存
      暂无估算
      查看详情
      查看运行方式(还有 2 种)
      llama-server -hf LiquidAI/LFM2.5-1.2B-JP-202606-GGUF

      其它 2 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      LFM1.0
      上下文
      32k
      国内可达
      需代理
    • Gemma 4 31B 量化图文模型,支持工具调用,本地部署

      参数量
      31B
      商用
      可商用

      当前运行配置 unsloth/gemma-4-31B-it-qat-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf unsloth/gemma-4-31B-it-qat-GGUF:UD-Q4_K_XL --spec-type draft-mtp --spec-draft-n-max 4 -ngl 999
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      256k
      国内可达
      需代理
      其它形态
      GGUF·unsloth · GGUF·google · GGUF·lmstudio
    • Gemma 4 视觉模型 abliteration 版 GGUF 量化

      商用
      限制商用

      当前运行配置 mradermacher/Gemma-4-E2B-Heretic-i1-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      ollama create gemma4-heretic -f Modelfile && ollama run gemma4-heretic

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      gemma
      国内可达
      需代理
    • 20B搜索智能体,对标前沿检索性能

      参数量
      20B
      商用
      需自查

      当前运行配置 pat-jj/harness-1

      显存
      暂无估算
      查看详情
      查看运行方式
      transformers from_pretrained('pat-jj/harness-1')
      为何暂无估算
      权重格式未知,无法估算显存
      国内可达
      需代理
    • 日语端到端语音对话,1.5B轻量实时交互

      参数量
      1.5B
      商用
      需自查

      当前运行配置 LiquidAI/LFM2.5-Audio-1.5B-JP

      显存
      暂无估算
      查看详情
      查看运行方式
      pip install liquid-audio
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      LFM Open License v1.0
      上下文
      32k
      国内可达
      需代理
    • LCB-medium 99%,12GB 级代码专家量化包

      参数量
      20.8B (A4B 活跃)
      商用
      可商用

      当前运行配置 ManniX-ITA/gemma-4-A4B-98e-v7-coderx-it-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      ollama pull mannix/gemma4-98e-v7-coderx:Q4_K_M

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
    • 零拒绝消融Gemma 4,供对齐研究与红队测试

      参数量
      12B
      商用
      限制商用

      当前运行配置 OBLITERATUS/Gemma-4-12B-OBLITERATED

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      ollama run hf.co/OBLITERATUS/Gemma-4-12B-OBLITERATED

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      gemma
      国内可达
      需代理
    • Ideogram 4 官方 NF4 量化,低显存本地出图

      商用
      需自查

      当前运行配置 ideogram-ai/ideogram-4-nf4

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      python -c 'from diffusers import DiffusionPipeline; pipe = DiffusionPipeline.from_pretrained("ideogram-ai/ideogram-4-nf4", torch_dtype=torch.bfloat16); pipe.to("cuda")'

      其它 1 种运行方式见详情页

      为何暂无估算
      缺少可用的显存依据
      许可证
      other
      国内可达
      需代理
    • 面向编码与工具调用的智能体模型

      参数量
      35B (A3B)
      商用
      可商用

      当前运行配置 nex-agi/Nex-N2-mini

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      python -m sglang.launch_server --model-path ./model --tp 2 --reasoning-parser qwen3 --tool-call-parser qwen3_coder

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      国内可达
      魔搭可用
    • Gemma 4 26B MoE 量化版,用于本地图像与文本推理

      参数量
      25.2B (3.8B active)
      商用
      可商用

      当前运行配置 unsloth/gemma-4-26B-A4B-it-qat-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式(还有 2 种)
      ollama run unsloth/gemma-4-26B-A4B-it-qat-GGUF

      其它 2 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0 (Gemma)
      上下文
      256K
      国内可达
      需代理
      其它形态
      GGUF·unsloth · GGUF·lmstudio
    • 7B 视觉语言模型 GGUF 量化包,适合本地 VQA 与对话

      参数量
      7B
      商用
      可商用

      当前运行配置 mradermacher/ZwZ-7B-i1-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      ollama create ZwZ-7B -f Modelfile(从 HF 下载 GGUF 后)

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache 2.0
      国内可达
      需代理
    • Google Gemma 4 12B QAT GGUF,本地多模态推理

      参数量
      12B
      商用
      可商用

      当前运行配置 lmstudio-community/gemma-4-12B-it-QAT-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf lmstudio-community/gemma-4-12B-it-QAT-GGUF
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      256K
      国内可达
      需代理
      其它形态
      GGUF·lmstudio · GGUF·google · GGUF·unsloth
    • Gemma 4 2B 指令 GGUF,本地推理

      参数量
      2B
      商用
      可商用

      当前运行配置 lmstudio-community/gemma-4-E2B-it-QAT-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama.cpp: ./llama-cli -m <gguf-file>
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
    • Google Gemma 4 量化版,本地消费级硬件推理

      参数量
      4B
      商用
      可商用

      当前运行配置 lmstudio-community/gemma-4-E4B-it-QAT-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama.cpp -m gemma-4-E4B-it-QAT.gguf
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      国内可达
      需代理
    • 苹果芯片4-bit MLX 量化 Qwen3.5-0.8B

      参数量
      0.8B
      商用
      可商用

      当前运行配置 mlx-community/Qwen3.5-0.8B-OptiQ-4bit

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      pip install mlx-lm; mlx_lm.generate --model mlx-community/Qwen3.5-0.8B-OptiQ-4bit --prompt '...'

      其它 1 种运行方式见详情页

      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      Apache 2.0
      国内可达
      需代理
    • 4-bit混合精度MLX量化Qwen3.5-2B,苹果芯片推理

      参数量
      2B
      商用
      可商用

      当前运行配置 mlx-community/Qwen3.5-2B-OptiQ-4bit

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      mlx-lm generate --model mlx-community/Qwen3.5-2B-OptiQ-4bit

      其它 1 种运行方式见详情页

      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
    • Qwen3.6-27B 的 MLX 推理加速版供苹果芯片

      参数量
      27B
      商用
      可商用

      当前运行配置 Youssofal/Qwen3.6-27B-MTPLX-Optimized-Speed

      显存
      ~16GB 4-bit(估算)
      查看详情
      查看运行方式(还有 2 种)
      brew install youssofal/mtplx/mtplx

      其它 2 种运行方式见详情页

      许可证
      Apache-2.0
      国内可达
      需代理
    • Apple Silicon的Qwen3.6-27B 4bit混合量化版

      参数量
      27B
      商用
      可商用

      当前运行配置 mlx-community/Qwen3.6-27B-OptiQ-4bit

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      mlx_lm.load('mlx-community/Qwen3.6-27B-OptiQ-4bit')

      其它 1 种运行方式见详情页

      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      Apache-2.0
      国内可达
      需代理
    • Apple Silicon 4-bit MLX混精量化+MTP投机解码

      参数量
      35B-A3B
      商用
      可商用

      当前运行配置 mlx-community/Qwen3.6-35B-A3B-OptiQ-4bit

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      optiq serve --model mlx-community/Qwen3.6-35B-A3B-OptiQ-4bit --mtp

      其它 1 种运行方式见详情页

      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      Apache-2.0
      国内可达
      需代理
    • 文本到图像生成模型,Ideogram 4 的 FP8 量化版本

      商用
      需自查

      当前运行配置 ideogram-ai/ideogram-4-fp8

      显存
      暂无估算
      查看详情
      查看运行方式
      diffusers: from_pretrained('ideogram-ai/ideogram-4-fp8')
      为何暂无估算
      缺少可用的显存依据
      许可证
      other
      国内可达
      需代理
    • 语音对话TTS:100+语种、零样克隆、情感/风格内联控制

      参数量
      4B
      商用
      需自查

      当前运行配置 bosonai/higgs-audio-v3-tts-4b

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      sgl-omni serve --model-path bosonai/higgs-audio-v3-tts-4b

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Boson Research & Non-Commercial License
      上下文
      8k
      语言
      100+语言,含中、英、日、韩、法、德等83种高质量语种
      国内可达
      需代理
    • 分钟级多镜头音视频长视频生成,面向研究者

      商用
      需自查

      当前运行配置 jdopensource/JoyAI-Echo

      显存
      暂无估算
      查看详情
      查看运行方式(还有 2 种)
      huggingface-cli download google/gemma-3-12b-it --local-dir checkpoints/gemma-3-12b/ && python inference.py

      其它 2 种运行方式见详情页

      为何暂无估算
      缺少可用的显存依据
      许可证
      LTX-2 Community License (研究/非商用)
      国内可达
      需代理
    • 面向数学证明的语义搜索嵌入模型,用于查找 mathlib 定理

      参数量
      8.2B
      商用
      可商用

      当前运行配置 delta-lab-ai/lean-finder

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      sentence-transformers SentenceTransformer('delta-lab-ai/lean-finder')

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      国内可达
      需代理
    • 直接回答的指令模型,用于交互聊天、代码和工具调用

      参数量
      12B (2.5B active)
      商用
      可商用

      当前运行配置 JetBrains/Mellum2-12B-A2.5B-Instruct

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      vllm serve JetBrains/Mellum2-12B-A2.5B-Instruct --max-model-len 131072

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      131k
      国内可达
      需代理
    • 基于 Sesame CSM 的对话 TTS 模型,支持语音上下文延续

      参数量
      8B
      商用
      需自查

      当前运行配置 MisoLabs/MisoTTS

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      git clone https://github.com/MisoLabsAI/MisoTTS && cd MisoTTS && pip install -r requirements.txt

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      other
      上下文
      2048
      语言
      未声明
      国内可达
      需代理
    • 覆盖40种语言的流式ASR,600M,可调延迟,面向实时语音代理

      参数量
      600M
      商用
      需自查

      当前运行配置 nvidia/nemotron-3.5-asr-streaming-0.6b

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      nemo_asr.models.ASRModel.from_pretrained('nvidia/nemotron-3.5-asr-streaming-0.6b')

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      NVIDIA Open Model License
      国内可达
      魔搭可用
    • 循环异构图语言模型,用于个性化微调与端侧推理

      参数量
      40.1M
      商用
      需自查

      当前运行配置 david-thrower/HelixLM-20260529-2240-d512-h8-nl3-ffn2-s512-1500MT-ep1

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      transformers from_pretrained(trust_remote_code=True)

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Modified Apache 2.0
      上下文
      1024
      国内可达
      需代理
    • 文本/图像生成音视频同步内容,支持多说话人音色控制

      参数量
      6.3B
      商用
      可商用

      当前运行配置 baidu/NAVA

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      git clone https://github.com/ernie-research/NAVA && cd NAVA && huggingface-cli download baidu/NAVA --local-dir .

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      文本 512 tokens · 最大 10 秒视频
      国内可达
      需代理
    • 12B 多模态模型,支持图文音频输入,本地 GGUF 量化部署

      参数量
      12B
      商用
      可商用

      当前运行配置 lmstudio-community/gemma-4-12B-it-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      ollama: ollama run hf.co/lmstudio-community/gemma-4-12B-it-GGUF:Q4_K_M
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache 2.0
      上下文
      256k
      国内可达
      需代理
      其它形态
      GGUF·lmstudio · GGUF·unsloth
    • 8.3B总参/1.5B活跃,面向端侧个人助手的混合架构模型

      参数量
      8.3B (1.5B active)
      商用
      需自查

      当前运行配置 LiquidAI/LFM2.5-8B-A1B

      显存
      暂无估算
      查看详情
      查看运行方式
      transformers >= 5.0.0: AutoModelForCausalLM.from_pretrained('LiquidAI/LFM2.5-8B-A1B')
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      LFM1.0
      上下文
      128k
      国内可达
      需代理
      其它形态
      原生 · GGUF·liquidai · GGUF·unsloth
    • 思考型助手,在<think>块中输出推理链后给出最终答案

      参数量
      12B
      商用
      可商用

      当前运行配置 JetBrains/Mellum2-12B-A2.5B-Thinking

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      vllm serve JetBrains/Mellum2-12B-A2.5B-Thinking --max-model-len 131072 --reasoning-parser qwen3

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache 2.0
      上下文
      131k
      国内可达
      需代理
    • 文本生成高保真图像,面向物理AI与创作

      参数量
      64B
      商用
      需自查

      当前运行配置 nvidia/Cosmos3-Super-Text2Image

      显存
      暂无估算
      查看详情
      查看运行方式(还有 2 种)
      vllm serve nvidia/Cosmos3-Super-Text2Image (vLLM-Omni)

      其它 2 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      OpenMDW1.1
      上下文
      4k tokens (文本输入)
      国内可达
      需代理
    • Qwen3.5-9B MoQ量化版,MTP推测解码,适合本地快速生成

      参数量
      9B
      商用
      可商用

      当前运行配置 w-ahmad/Qwen3.5-9B-GGUF-MoQ-MTP

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      ollama run hf.co/w-ahmad/Qwen3.5-9B-GGUF-MoQ-MTP

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MIT
      上下文
      32k
      国内可达
      需代理
    • Qwen3.6-35B-A3B FP4量化版,面向vLLM高效推理

      参数量
      35B (激活3B)
      商用
      可商用

      当前运行配置 nvidia/Qwen3.6-35B-A3B-NVFP4

      显存
      暂无估算
      查看详情
      查看运行方式
      vllm serve nvidia/Qwen3.6-35B-A3B-NVFP4 --quantization modelopt
      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      Apache 2.0
      上下文
      262k
      国内可达
      需代理
    • 指令式多语言TTS,流式延迟低至97ms,9音色

      参数量
      1.7B
      商用
      可商用

      当前运行配置 Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice

      显存
      暂无估算
      查看详情
      查看运行方式(还有 2 种)
      pip install qwen-tts && python -c 'from qwen_tts import Qwen3TTSModel; model=Qwen3TTSModel.from_pretrained("Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice", device_map="cuda:0")'

      其它 2 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      国内可达
      魔搭可用
    • 1.21GB三元文生图模型,4步采样,本地GPU运行

      参数量
      4B
      商用
      可商用

      当前运行配置 prism-ml/bonsai-image-ternary-4B-gemlite-2bit

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      Python API: from backend_gpu.server import build_pipeline; pipe = build_pipeline('prism-ml/bonsai-image-ternary-4B-gemlite-2bit')

      其它 1 种运行方式见详情页

      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      Apache-2.0
      上下文
      不适用
      国内可达
      需代理
    • 1.21GB 三元文生图扩散模型,苹果芯片本地运行

      参数量
      4B
      商用
      可商用

      当前运行配置 prism-ml/bonsai-image-ternary-4B-mlx-2bit

      显存
      暂无估算
      查看详情
      查看运行方式
      macOS: git clone https://github.com/PrismML-Eng/Bonsai-Image-Demo && cd Bonsai-Image-Demo && ./setup.sh && ./scripts/download_model.sh && ./scripts/generate.sh
      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      apache-2.0
      上下文
      不适用
      国内可达
      需代理
    • 1-bit量化文生图模型,专为Apple Silicon本地运行

      参数量
      4B
      商用
      可商用

      当前运行配置 prism-ml/bonsai-image-binary-4B-mlx-1bit

      显存
      ~0.6GB 1-bit(估算)
      查看详情
      查看运行方式
      MLX Python: BONSAI_VARIANT=binary ./scripts/generate.sh --prompt "..."
      许可证
      apache-2.0
      国内可达
      需代理
    • 零样本语音克隆多语言TTS模型,支持31种语言及显式暂停控制。

      参数量
      8.5B
      商用
      可商用

      当前运行配置 OpenMOSS-Team/MOSS-TTS-v1.5

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      transformers.AutoModel.from_pretrained('OpenMOSS-Team/MOSS-TTS-v1.5')

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      国内可达
      魔搭可用
    • 1B 模型 GGUF 量化,本地 agent 与边缘部署用

      参数量
      1B
      商用
      可商用

      当前运行配置 openbmb/MiniCPM5-1B

      显存
      暂无估算
      查看详情
      查看运行方式(还有 2 种)
      vllm serve openbmb/MiniCPM5-1B --port 8000

      其它 2 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      128k
      国内可达
      魔搭可用
      其它形态
      原生 · GGUF
    • 昇腾原生1.58-bit三元LLM,推理内存降6x,保持95.7%性能

      参数量
      8B
      商用
      可商用

      当前运行配置 openbmb/BitCPM-CANN-8B

      显存
      ~2.2GB ternary(估算)
      查看详情
      查看运行方式(还有 1 种)
      ollama create 从 https://huggingface.co/openbmb/BitCPM-CANN-8B-gguf 导入

      其它 1 种运行方式见详情页

      许可证
      apache-2.0
      国内可达
      需代理
    • 文本到图像生成,用于开发者与创作者的视觉内容创建

      参数量
      12B
      商用
      需自查

      当前运行配置 black-forest-labs/FLUX.1-dev

      显存
      暂无估算
      查看详情
      查看运行方式
      diffusers: FluxPipeline.from_pretrained('black-forest-labs/FLUX.1-dev')
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      非商业许可
      上下文
      不适用
      国内可达
      需代理
    • 面向远场、混响、重叠语音等严重声学退化的鲁棒语音识别

      参数量
      1.7B
      商用
      可商用

      当前运行配置 zhifeixie/Mega-ASR

      显存
      暂无估算
      查看详情
      查看运行方式(还有 2 种)
      from MegaASR.model.megaASR import MegaASR

      其它 2 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
    • 像素扩散解码器,将潜在表征一步超分至2K/4K图像

      商用
      需自查

      当前运行配置 nvidia/PiD

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      hf download nvidia/PiD --local-dir . --include 'checkpoints/*'

      其它 1 种运行方式见详情页

      为何暂无估算
      缺少可用的显存依据
      许可证
      NVIDIA Internal SRDML (仅限研究)
      国内可达
      需代理
    • 为ARO语言微调的代码生成器,4bit量化,供ARO DSL开发者使用

      参数量
      30B (3B active)
      商用
      可商用

      当前运行配置 ARO-Lang/aro-coder-4bit

      显存
      ~18GB 4-bit(估算)
      查看详情
      查看运行方式(还有 2 种)
      ollama run aro-coder

      其它 2 种运行方式见详情页

      许可证
      MIT
      国内可达
      需代理
    • 轻量多语言翻译模型,支持 llama.cpp 本地部署

      参数量
      1.8B
      商用
      可商用

      当前运行配置 tencent/Hy-MT2-1.8B-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf tencent/Hy-MT2-1.8B-GGUF
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      国内可达
      魔搭可用
    • 多说话人分割模型,从音频中区分谁在何时说话

      商用
      可商用

      当前运行配置 pyannote/speaker-diarization-3.1

      显存
      暂无估算
      查看详情
      查看运行方式(还有 2 种)
      pip install pyannote.audio && from pyannote.audio import Pipeline; pipeline = Pipeline.from_pretrained('pyannote/speaker-diarization-3.1')

      其它 2 种运行方式见详情页

      为何暂无估算
      缺少可用的显存依据
      许可证
      mit
      上下文
      不适用(音频长度可分批)
      国内可达
      需代理
    • 3.8B文本生成图像基础模型,高效训练与高分辨率生成

      参数量
      3.8B
      商用
      可商用

      当前运行配置 microsoft/Lens

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      git clone https://github.com/microsoft/Lens && python inference.py

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MIT
      国内可达
      需代理
    • 移除拒绝回路,能力保持,本地全栈部署

      参数量
      26.9B
      商用
      可商用

      当前运行配置 OBLITERATUS/Qwen3.6-27B-OBLITERATED

      显存
      暂无估算
      查看详情
      查看运行方式(还有 2 种)
      ollama run hf.co/OBLITERATUS/Qwen3.6-27B-OBLITERATED

      其它 2 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      8192
      国内可达
      需代理
    • 多Token预测推理模型,面向编码、数学、DevOps开发者

      参数量
      27B
      商用
      可商用

      当前运行配置 Jackrong/Qwopus3.6-27B-v2-MTP-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      llama.cpp server -m qwopus3.6-27b-v2-mtp.Q4_K_M.gguf -ngl 99

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache 2.0
      上下文
      128k
      国内可达
      需代理
      其它形态
      GGUF·jackrong·MTP · GGUF·jackrong
    • 3.8B 高效文生图,4 步蒸馏,为开发者与创作者快速生成

      参数量
      3.8B
      商用
      可商用

      当前运行配置 microsoft/Lens-Turbo

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      CLI: git clone https://github.com/microsoft/Lens && python inference.py --repo_id microsoft/Lens-Turbo

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MIT
      国内可达
      需代理
    • Llama-3-8B 4-bit版,M系列芯片本地推理

      参数量
      8B
      商用
      限制商用

      当前运行配置 mlx-community/Meta-Llama-3-8B-Instruct-4bit

      显存
      ~4.8GB 4-bit(估算)
      查看详情
      查看运行方式(还有 1 种)
      pip install mlx-lm && mlx_lm.generate --model mlx-community/Meta-Llama-3-8B-Instruct-4bit --prompt "hello"

      其它 1 种运行方式见详情页

      许可证
      llama3
      上下文
      8k
      国内可达
      需代理
    • 三元1.58-bit量化8B模型,苹果芯片本地推理

      参数量
      8B
      商用
      可商用

      当前运行配置 prism-ml/Ternary-Bonsai-8B-mlx-2bit

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      mlx_lm.load('prism-ml/Ternary-Bonsai-8B-mlx-2bit')

      其它 1 种运行方式见详情页

      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      Apache-2.0
      上下文
      65k
      国内可达
      需代理
    • Google 31B 指令模型 GGUF 量化版,本地消费级硬件推理

      参数量
      31B
      商用
      可商用

      当前运行配置 lmstudio-community/gemma-4-31B-it-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      ollama run hf.co/lmstudio-community/gemma-4-31B-it-GGUF:Q4_K_M

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
    • IBM Granite 30B GGUF量化, 本地部署与推理

      参数量
      30B
      商用
      可商用

      当前运行配置 lmstudio-community/granite-4.1-30b-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama.cpp: huggingface-cli download lmstudio-community/granite-4.1-30b-GGUF --include '*.gguf' --local-dir . && ./llama-cli -m <file>
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache 2.0
      国内可达
      需代理
    • IBM Granite 4.1 3B GGUF量化,本地推理与边缘部署

      参数量
      3B
      商用
      可商用

      当前运行配置 lmstudio-community/granite-4.1-3b-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama.cpp -m granite-4.1-3b-Q4_K_M.gguf
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      国内可达
      需代理
    • IBM Granite 4.1 8B的GGUF量化,用于本地推理

      参数量
      8B
      商用
      可商用

      当前运行配置 lmstudio-community/granite-4.1-8b-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama.cpp -m granite-4.1-8b.gguf
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
    • Apple芯片上本地运行的Llama2 7B对话模型

      参数量
      7B
      商用
      限制商用

      当前运行配置 mlx-community/Llama-2-7b-chat-mlx

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      python mlx-examples/llama/llama.py --prompt 'Hi' model/

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      llama2
      上下文
      4096
      国内可达
      需代理
    • MiniMax M2.7 GGUF量化版,适合本地部署与实验

      参数量
      2.7B

      当前运行配置 lmstudio-community/MiniMax-M2.7-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      ollama create MiniMax-M2.7 -f Modelfile (FROM ./file.gguf)

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      other
      国内可达
      需代理
    • NVIDIA 多模态推理模型 GGUF 量化版,本地推理用

      参数量
      30B (3B 激活)

      当前运行配置 lmstudio-community/Nemotron-3-Nano-Omni-30B-A3B-Reasoning-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -hf lmstudio-community/Nemotron-3-Nano-Omni-30B-A3B-Reasoning-GGUF
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      NVIDIA Open Model Agreement
      国内可达
      需代理
    • 三模式 LM (AR/扩散/自推测),为 AI 应用开发者提供高效生成

      参数量
      14B

      当前运行配置 nvidia/Nemotron-Labs-Diffusion-14B

      显存
      暂无估算
      查看详情
      查看运行方式
      transformers from_pretrained()
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      NVIDIA Nemotron Open Model License
      国内可达
      需代理
    • 文档结构化提取和Markdown转换的4B视觉语言模型

      参数量
      4B
      商用
      可商用

      当前运行配置 numind/NuExtract3

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      vllm serve numind/NuExtract3 --trust-remote-code --limit-mm-per-prompt '{"image": 99, "video": 0}'

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      131k
      国内可达
      需代理
    • Qwen3.5-9B 多模态模型,MTP 投机解码,本地快速运行

      参数量
      9B
      商用
      可商用

      当前运行配置 unsloth/Qwen3.5-9B-MTP-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      git clone https://github.com/ggml-org/llama.cpp && cd llama.cpp && cmake -B build -DGGML_CUDA=ON && cmake --build build --target llama-server

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      262k (可扩展至1M)
      国内可达
      需代理
    • 27B参数GGUF版,本地AI原型开发

      参数量
      27B
      商用
      可商用

      当前运行配置 unsloth/Qwen3.6-27B-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      llama.cpp: ./main -m Qwen3.6-27B-Q4_K_M.gguf
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      262k (可扩展至1M)
      国内可达
      需代理
      其它形态
      GGUF·unsloth · GGUF·lmstudio · GGUF·unsloth·MTP
    • 35B MoE仅3B激活的GGUF量化版,适合本地中文开发

      参数量
      35B (3B 激活)
      商用
      可商用

      当前运行配置 unsloth/Qwen3.6-35B-A3B-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      ollama run hf.co/unsloth/Qwen3.6-35B-A3B-GGUF

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      262k (可扩展至1M)
      国内可达
      需代理
      其它形态
      GGUF·unsloth · GGUF·lmstudio · GGUF·unsloth·MTP
    • 9B多令牌预测代码模型,GGUF量化,面向代码推理

      参数量
      9B
      商用
      可商用

      当前运行配置 Jackrong/Qwopus3.5-9B-Coder-MTP-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式(还有 2 种)
      ollama run hf.co/Jackrong/Qwopus3.5-9B-Coder-MTP-GGUF:Q4_K_M

      其它 2 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      128k
      国内可达
      需代理
      其它形态
      GGUF·jackrong·MTP · GGUF·jackrong
    • 26B总参/4B活跃的MoE指令模型,面向本地推理

      参数量
      26B (4B活跃)
      商用
      可商用

      当前运行配置 lmstudio-community/gemma-4-26B-A4B-it-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      llama-cli -m gemma-4-26B-A4B-it-Q4_K_M.gguf -p 你好

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      128k
      国内可达
      需代理
    • 谷歌 Gemma 4 指令模型 GGUF 量化版,本地高效部署

      商用
      可商用

      当前运行配置 lmstudio-community/gemma-4-E2B-it-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      lmstudio://download?model=lmstudio-community/gemma-4-E2B-it-GGUF

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
    • Gemma4-4B-it 量化版, 本地轻量推理

      参数量
      4B
      商用
      可商用

      当前运行配置 lmstudio-community/gemma-4-E4B-it-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      huggingface-cli download lmstudio-community/gemma-4-E4B-it-GGUF
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
    • Apple Silicon 的 1-bit LLM,端侧极低内存推理

      参数量
      8B
      商用
      可商用

      当前运行配置 prism-ml/Bonsai-8B-mlx-1bit

      显存
      ~1.2GB 1-bit(估算)
      查看详情
      查看运行方式
      pip install mlx-lm; pip install mlx@git+https://github.com/PrismML-Eng/mlx.git@prism; from mlx_lm import load; load('prism-ml/Bonsai-8B-mlx-1bit')
      许可证
      Apache-2.0
      上下文
      65k
      国内可达
      需代理
    • 1B预对齐前缀LM,用前缀条件做结构化输出与推理

      参数量
      1B
      商用
      可商用

      当前运行配置 sapientinc/HRM-Text-1B

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      AutoModelForCausalLM.from_pretrained('sapientinc/HRM-Text-1B', trust_remote_code=True)

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      4096
      国内可达
      需代理
    • LTX-2.3模型的ComfyUI工作流集合,用于图像/视频生成。

      当前运行配置 RuneXX/LTX-2.3-Workflows

      显存
      暂无估算
      查看详情
      查看运行方式
      git clone https://huggingface.co/RuneXX/LTX-2.3-Workflows
      为何暂无估算
      缺少可用的显存依据
      国内可达
      需代理
    • 为开发者输出最少代码行的可运行代码

      参数量
      0.5B
      商用
      可商用

      当前运行配置 salakash/Minimalism

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      mlx_lm.server --model mlx-community/Qwen2.5-Coder-0.5B-Instruct-4bit --adapter-path salakash/Minimalism --port 8080

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      32k
      国内可达
      需代理
    • Gemma4 26B 无审查 MLX, 本地代理加速

      参数量
      26B (4-bit)
      商用
      限制商用

      当前运行配置 Jiunsong/supergemma4-26b-uncensored-mlx-4bit-v2

      显存
      ~16GB 4-bit(估算)
      查看详情
      查看运行方式(还有 1 种)
      mlx_lm.server --model Jiunsong/supergemma4-26b-uncensored-mlx-4bit-v2

      其它 1 种运行方式见详情页

      许可证
      gemma
      国内可达
      需代理
    • Mac端Whisper large-v3-turbo,MLX低延迟转写

      参数量
      809M

      当前运行配置 mlx-community/whisper-large-v3-turbo

      显存
      暂无估算
      查看详情
      查看运行方式
      pip install mlx-whisper && mlx_whisper audio.wav --model mlx-community/whisper-large-v3-turbo
      为何暂无估算
      权重格式未知,无法估算显存
      上下文
      30s
      国内可达
      需代理
    • 覆盖4000+语言的语音基础模型,供ASR/翻译微调

      参数量
      577M
      商用
      不可商用

      当前运行配置 espnet/xeus

      显存
      暂无估算
      查看详情
      查看运行方式(还有 2 种)
      python -c "from espnet2.tasks.ssl import SSLTask; model, _ = SSLTask.build_model_from_file(None, 'espnet/XEUS/checkpoint.pth', 'cuda')"

      其它 2 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      CC BY-NC-SA 4.0
      国内可达
      需代理
    • 像素空间文生图模型,基于AsymFlow,适合文字渲染与细节生成

      参数量
      9B

      当前运行配置 Lakonik/AsymFLUX.2-klein-9B

      显存
      暂无估算
      查看详情
      查看运行方式
      Python: pip install lakonlab 后用 PixelFlux2KleinPipeline 加载适配器
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      flux-non-commercial-license
      国内可达
      需代理
    • 无审查的Gemma 4多模态模型,适合内容生成开发者

      参数量
      4B
      商用
      限制商用

      当前运行配置 HauhauCS/Gemma-4-E4B-Uncensored-HauhauCS-Aggressive

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      llama-cli -m ./gemma4-unc/Gemma-4-E4B-Uncensored-HauhauCS-Aggressive-Q4_K_M.gguf --mmproj ./gemma4-unc/mmproj-Gemma-4-E4B-Uncensored-HauhauCS-Aggressive-f16.gguf --jinja -c 8192 -ngl 99

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Gemma
      上下文
      131k
      国内可达
      需代理
    • Gemma4 无审查多模态 MoE,面向创意写作与角色扮演

      参数量
      26B (25.2B total, 3.8B active)
      商用
      可商用

      当前运行配置 HauhauCS/Gemma4-26B-A4B-Uncensored-HauhauCS-Balanced

      显存
      暂无估算
      查看详情
      查看运行方式
      llama-server -m Gemma4-26B-A4B-Uncensored-HauhauCS-Balanced-Q4_K_P.gguf --mmproj mmproj-Gemma4-26B-A4B-Uncensored-HauhauCS-Balanced-f16.gguf --jinja -c 32768 -ngl 99
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      Apache-2.0
      上下文
      256K
      国内可达
      需代理
    • 日语TTS,表情符号控制风格,零样本克隆

      参数量
      500M
      商用
      可商用

      当前运行配置 Aratako/Irodori-TTS-500M-v3

      显存
      暂无估算
      查看详情
      查看运行方式
      git clone https://github.com/Aratako/Irodori-TTS
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      MIT
      国内可达
      需代理
    • LTX2.3 微调的图生视频 GGUF 模型,用于 ComfyUI

      当前运行配置 vantagewithai/LTX2.3-10Eros-GGUF

      显存
      暂无估算
      查看详情
      查看运行方式
      git clone https://github.com/TenStrip/10S-Comfy-nodes custom_nodes/
      为何暂无估算
      缺少可用的显存依据
      国内可达
      需代理
    • 解禁版Qwen3.6-27B量化模型,为创意写作与代码而生

      参数量
      27B
      商用
      可商用

      当前运行配置 DavidAU/Qwen3.6-27B-Heretic-Uncensored-FINETUNE-NEO-CODE-Di-IMatrix-MAX-GGUF

      显存
      ~57GB BF16(估算)
      查看详情
      查看运行方式
      llama-server -hf DavidAU/Qwen3.6-27B-Heretic-Uncensored-FINETUNE-NEO-CODE-Di-IMatrix-MAX-GGUF
      许可证
      apache-2.0
      上下文
      256k
      国内可达
      需代理
    • 无审查Gemma 4 26B GGUF,适合苹果硅本地快速推理

      参数量
      26B
      商用
      限制商用

      当前运行配置 Jiunsong/supergemma4-26b-uncensored-gguf-v2

      显存
      暂无估算
      查看详情
      查看运行方式(还有 2 种)
      ollama run hf.co/Jiunsong/supergemma4-26b-uncensored-gguf-v2

      其它 2 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      gemma
      国内可达
      需代理
    • 多模态嵌入模型,支持文本/图像/视频/音频

      参数量
      1.74B
      商用
      不可商用

      当前运行配置 jinaai/jina-embeddings-v5-omni-small

      显存
      暂无估算
      查看详情
      查看运行方式(还有 2 种)
      vllm serve jinaai/jina-embeddings-v5-omni-small --trust-remote-code --hf-overrides '{"task":"retrieval"}'

      其它 2 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      cc-by-nc-4.0
      上下文
      32768
      国内可达
      需代理
    • 通用文本转语音,面向配音与有声内容制作者

      当前运行配置 ResembleAI/Dramabox

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      snapshot_download('ResembleAI/Dramabox')

      其它 1 种运行方式见详情页

      为何暂无估算
      缺少可用的显存依据
      许可证
      other
      上下文
      不适用
      国内可达
      需代理
    • 文本到图像扩散模型,面向 AI 应用构建者

      商用
      不可商用

      当前运行配置 RunDiffusion/Juggernaut-Z-Image

      显存
      暂无估算
      查看详情
      查看运行方式
      diffusers: from_pretrained('RunDiffusion/Juggernaut-Z-Image')
      为何暂无估算
      缺少可用的显存依据
      许可证
      cc-by-nc-4.0
      国内可达
      需代理
    • 通用问答模型,适合知识型对话与事实查询。

      参数量
      14B
      商用
      可商用

      当前运行配置 jackxinning/Leanly_AI

      显存
      暂无估算
      查看详情
      查看运行方式
      transformers: AutoModel.from_pretrained('jackxinning/Leanly_AI')
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
    • 600M参数早期检查点,面向低资源多语言部署

      参数量
      600M
      商用
      可商用

      当前运行配置 FrontiersMind/Nandi-Mini-600M-Early-Checkpoint

      显存
      暂无估算
      查看详情
      查看运行方式
      transformers.from_pretrained('FrontiersMind/Nandi-Mini-600M-Early-Checkpoint')
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      2048
      国内可达
      需代理
    • 为开发者提供600+语言零样本语音合成

      参数量
      613M
      商用
      可商用

      当前运行配置 k2-fsa/OmniVoice

      显存
      暂无估算
      查看详情
      查看运行方式
      pip install omnivoice
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      上下文
      不适用
      国内可达
      需代理
    • 35B MoE多模态去审查模型,适合本地无限制输出

      参数量
      35B
      商用
      可商用

      当前运行配置 HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive

      显存
      暂无估算
      查看详情
      查看运行方式(还有 3 种)
      ollama run fredrezones55/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive:Q4_K_P

      其它 3 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
    • 多模态无审查推理模型,面向代码与视觉应用

      参数量
      40B
      商用
      可商用

      当前运行配置 DavidAU/Qwen3.6-40B-Claude-4.6-Opus-Deckard-Heretic-Uncensored-Thinking-NEO-CODE-Di-IMatrix-MAX-GGUF

      显存
      ~84GB BF16(估算)
      查看详情
      查看运行方式(还有 1 种)
      llama-cli -m <gguf-file> -p '你的提示'

      其它 1 种运行方式见详情页

      许可证
      apache-2.0
      国内可达
      需代理
    • 图像到视频基座模型,GGUF量化版,适合本地推理

      参数量
      22B

      当前运行配置 SulphurAI/Sulphur-2-base

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      diffusers.from_pretrained('SulphurAI/Sulphur-2-base')

      其它 1 种运行方式见详情页

      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      other
      国内可达
      需代理
      其它形态
      原生 · GGUF
    • 31种语言本地TTS,面向AI应用开发者的语音合成

      参数量
      99M
      商用
      限制商用

      当前运行配置 Supertone/supertonic-3

      显存
      暂无估算
      查看详情
      查看运行方式
      pip install supertonic
      为何暂无估算
      权重格式未知,无法估算显存
      许可证
      OpenRAIL-M
      国内可达
      需代理
    • 动漫风格图像生成,面向二次元AI应用开发者

      参数量
      4B
      商用
      可商用

      当前运行配置 SeeSee21/Z-Anime

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      from diffusers import StableDiffusionPipeline; pipe = StableDiffusionPipeline.from_pretrained('SeeSee21/Z-Anime')

      其它 1 种运行方式见详情页

      为何暂无估算
      格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
      许可证
      apache-2.0
      国内可达
      需代理
    • TTS 模型,面向语音合成开发者

      当前运行配置 ScenemaAI/scenema-audio

      显存
      暂无估算
      查看详情
      查看运行方式(还有 1 种)
      huggingface-cli download ScenemaAI/scenema-audio

      其它 1 种运行方式见详情页

      为何暂无估算
      缺少可用的显存依据
      许可证
      other
      国内可达
      需代理

    最近更新

    按收录日期排列 · 共 381 个 · 第 111 期 2026-09-17 → · 全部归档 →