开源模型选型
来自 HuggingFace · 值得本地跑的开源模型 · 共 381 个
按任务、硬件和许可筛选候选;命令与次要规格在卡片里按需展开。
筛选
共 381 个模型
当前运行配置
mradermacher/Ornith-1.5-9B-uncensored-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf mradermacher/Ornith-1.5-9B-uncensored-GGUF- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 国内可达
- 需代理
当前运行配置
batuhan-elibuyuk/logicer-ggufs-public- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf batuhan-elibuyuk/logicer-ggufs-public- 为何暂无估算
- 缺少可用的参数量依据,无法估算显存
- 国内可达
- 需代理
当前运行配置
DavidAU/Qwen3.8-27B-TWIN-TURBO-Fable-Cold-Fusion-709-L-Uncensored-NM-DAU-NEO-MTP-GGUF- 显存
- ~57GB BF16(估算)
查看详情查看运行方式
llama-server -hf DavidAU/Qwen3.8-27B-TWIN-TURBO-Fable-Cold-Fusion-709-L-Uncensored-NM-DAU-NEO-MTP-GGUF- 许可证
- Apache-2.0
- 上下文
- 256k
- 国内可达
- 需代理
当前运行配置
ukisai/Swift-Qwen3.8-27B-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf ukisai/Swift-Qwen3.8-27B-GGUF:Q4_K_M --jinja -fa on -ngl 99 -c 262144 --temp 1.0 --top-p 0.95 --top-k 20 --min-p 0 --presence-penalty 0 --repeat-penalty 1.0- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Swift Open License v1.0 (gated)
- 上下文
- 262k
- 国内可达
- 需代理
当前运行配置
ChrisColeTech/LTX-2.5-uncensored-v1.1-FP8- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 缺少可用的显存依据
- 国内可达
- 需代理
当前运行配置
ReliquaryForge/qwen3-4b-base-dapo-v4- 显存
- 暂无估算
查看详情查看运行方式
vllm serve ReliquaryForge/qwen3-4b-base-dapo-v4- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 上下文
- 32k
- 国内可达
- 需代理
当前运行配置
thesysdev/OUI-1- 显存
- 暂无估算
查看详情查看运行方式
vllm serve thesysdev/OUI-1 --trust-remote-code --max-model-len 16384 --served-model-name OUI-1 --enable-auto-tool-choice --tool-call-parser gemma4- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache 2.0
- 上下文
- 16k
- 国内可达
- 需代理
当前运行配置
Mihai-LeanZero/Qwen3.5-9B-Atlassian-Q4-mlx- 显存
- ~5.4GB 4-bit(估算)
查看详情查看运行方式
mlx_lm.generate --model Mihai-LeanZero/Qwen3.5-9B-Atlassian-Q4-mlx --prompt "Which Forge module adds a panel to the Jira issue view?"- 许可证
- Apache-2.0
- 上下文
- 32k
- 国内可达
- 需代理
- 其它形态
- MLX·mihai-leanzero · MLX·mihai-leanzero
当前运行配置
Mihai-LeanZero/Qwen3.8-27B-Atlassian-Q8-mlx- 显存
- ~30GB 8-bit(估算)
查看详情查看运行方式
mlx_lm.generate --model Mihai-LeanZero/Qwen3.8-27B-Atlassian-Q8-mlx- 许可证
- Apache-2.0
- 上下文
- 128k
- 国内可达
- 需代理
- 其它形态
- MLX·mihai-leanzero · MLX·mihai-leanzero
本档靠
Mihai-LeanZero/Qwen3.8-27B-Atlassian-Q4-mlx(MLX·mihai-leanzero)- 显存
- ~16GB 4-bit(估算)
下方显存与命令都属于这个配置
查看详情查看运行方式
mlx_lm.generate --model Mihai-LeanZero/Qwen3.8-27B-Atlassian-Q4-mlx --prompt "Which Forge module adds a panel to the Jira issue view?"- 许可证
- Apache-2.0
- 上下文
- 128k
- 国内可达
- 需代理
- 其它形态
- MLX·mihai-leanzero · MLX·mihai-leanzero
本档靠
Mihai-LeanZero/Qwen3.8-27B-Atlassian-Q4-mlx(MLX·mihai-leanzero)- 显存
- ~16GB 4-bit(估算)
下方显存与命令都属于这个配置
查看详情查看运行方式
mlx_lm.generate --model Mihai-LeanZero/Qwen3.8-27B-Atlassian-Q4-mlx --prompt "Which Forge module adds a panel to the Jira issue view?"- 许可证
- Apache-2.0
- 上下文
- 128k
- 国内可达
- 需代理
- 其它形态
- MLX·mihai-leanzero · MLX·mihai-leanzero
当前运行配置
tencent/AuK- 显存
- 暂无估算
查看详情查看运行方式
python -m sglang_omni.cli serve --model-path tencent/AuK- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- MIT
- 语言
- 未公开
- 国内可达
- 魔搭可用
当前运行配置
Edge0/Edge0-35B-A3B-preview- 显存
- ~21GB 4-bit(估算)
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 许可证
- Apache-2.0
- 国内可达
- 需代理
当前运行配置
meshllm/Kimi-K3-UD-Q4_K_XL-layers- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 缺少可用的参数量依据,无法估算显存
- 国内可达
- 需代理
当前运行配置
TokenRhythm/NeoHorse-1-4B- 显存
- 暂无估算
查看详情查看运行方式
vllm serve TokenRhythm/NeoHorse-1-4B --reasoning-parser qwen3 --enable-auto-tool-choice --tool-call-parser qwen3_coder- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 262k (可扩至 1.01M)
- 国内可达
- 魔搭可用
当前运行配置
inclusionAI/LLaDA-Image- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 国内可达
- 魔搭可用
当前运行配置
dasLOL/mt-support-3g-v2- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 缺少可用的参数量依据,无法估算显存
- 国内可达
- 需代理
当前运行配置
openbmb/MiniCPM5-2B- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf openbmb/MiniCPM5-2B-GGUF- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 131k
- 国内可达
- 魔搭可用
- 其它形态
- 原生 · GGUF
当前运行配置
nex-agi/Nex-N2.5-Pro- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 缺少可用的参数量依据,无法估算显存
- 许可证
- apache-2.0
- 国内可达
- 魔搭可用
当前运行配置
nex-agi/Nex-N2.5-mini- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 国内可达
- 魔搭可用
当前运行配置
TheDrainFlorist/Qwen3.6-35B-A3B-VQ-3.4bpw- 显存
- 暂无估算
查看详情查看运行方式
python -m mlx_lm generate --model TheDrainFlorist/Qwen3.6-35B-A3B-VQ-3.4bpw --prompt 'Explain the difference between a mutex and a semaphore.' --max-tokens 512- 为何暂无估算
- 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
- 许可证
- apache-2.0
- 国内可达
- 需代理
当前运行配置
XHToken/Spark-X2.5-4B- 显存
- 暂无估算
查看详情查看运行方式
vllm serve XHToken/Spark-X2.5-4B --trust-remote-code- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 1M
- 国内可达
- 需代理
- 其它形态
- 原生 · GGUF
当前运行配置
unsloth/DeepSeek-V4-Flash-Vision-Exp-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf unsloth/DeepSeek-V4-Flash-Vision-Exp-GGUF- 为何暂无估算
- 缺少可用的参数量依据,无法估算显存
- 许可证
- MIT
- 国内可达
- 需代理
当前运行配置
TheDrainFlorist/Qwen3.6-35B-A3B-VQ-3.8bpw- 显存
- 暂无估算
查看详情查看运行方式
python -m mlx_lm generate --model TheDrainFlorist/Qwen3.6-35B-A3B-VQ-3.8bpw- 为何暂无估算
- 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
- 许可证
- Apache-2.0
- 国内可达
- 需代理
当前运行配置
TheDrainFlorist/Qwen3.6-35B-A3B-VQ-4.6bpw- 显存
- 暂无估算
查看详情查看运行方式
python -m mlx_lm generate --model TheDrainFlorist/Qwen3.6-35B-A3B-VQ-4.6bpw --prompt "Hello"- 为何暂无估算
- 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
- 许可证
- apache-2.0
- 国内可达
- 需代理
当前运行配置
TheDrainFlorist/Qwen3.6-35B-A3B-VQ-5.4bpw- 显存
- 暂无估算
查看详情查看运行方式
python -m mlx_lm generate --model TheDrainFlorist/Qwen3.6-35B-A3B-VQ-5.4bpw --prompt "Hello" --max-tokens 32- 为何暂无估算
- 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
- 许可证
- Apache-2.0
- 国内可达
- 需代理
当前运行配置
microsoft/VibeVoice-ASR-Streaming-7B- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- MIT
- 国内可达
- 需代理
当前运行配置
IFM/K2-Horizon-7B- 显存
- 暂无估算
查看详情查看运行方式
vllm serve IFM/K2-Horizon-7B --trust-remote-code --dtype bfloat16 --max-model-len 131072 --reasoning-parser k2_horizon --enable-auto-tool-choice --tool-call-parser k2_horizon- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 上下文
- 512k
- 国内可达
- 需代理
当前运行配置
IFM/K2-Horizon-MoVA-36B-A4B- 显存
- 暂无估算
查看详情查看运行方式
vllm serve IFM/K2-Horizon-MoVA-36B-A4B --trust-remote-code --reasoning-parser k2_horizon --tool-call-parser k2_horizon --enable-auto-tool-choice- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 512k
- 国内可达
- 需代理
- 其它形态
- 原生 · GGUF
当前运行配置
TheDrainFlorist/Qwen3.8-27B-VQ-3.9bpw- 显存
- 暂无估算
查看详情查看运行方式
python -m mlx_lm generate --model TheDrainFlorist/Qwen3.8-27B-VQ-3.9bpw --prompt "Explain vector quantization briefly." --max-tokens 512- 为何暂无估算
- 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
- 许可证
- Apache-2.0
- 国内可达
- 需代理
当前运行配置
TheDrainFlorist/Qwen3.8-27B-VQ-4.5bpw- 显存
- 暂无估算
查看详情查看运行方式
python -m mlx_lm generate --model TheDrainFlorist/Qwen3.8-27B-VQ-4.5bpw --prompt "Explain vector quantization briefly." --max-tokens 512- 为何暂无估算
- 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
- 许可证
- apache-2.0
- 国内可达
- 需代理
当前运行配置
TheDrainFlorist/Qwen3.8-27B-VQ-4.8bpw- 显存
- 暂无估算
查看详情查看运行方式
python -m mlx_lm generate --model TheDrainFlorist/Qwen3.8-27B-VQ-4.8bpw --prompt "Explain vector quantization briefly." --max-tokens 512- 为何暂无估算
- 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
- 许可证
- Apache-2.0
- 国内可达
- 需代理
当前运行配置
AngelSlim/Hy4-preview-GGUF- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 缺少可用的参数量依据,无法估算显存
- 国内可达
- 需代理
当前运行配置
Jackrong/Qwopus3.8-27B-Flash-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf Jackrong/Qwopus3.8-27B-Flash-GGUF- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 国内可达
- 需代理
当前运行配置
XHToken/Spark-X2.5-1.7B- 显存
- 暂无估算
查看详情查看运行方式
vllm serve XHToken/Spark-X2.5-1.7B --trust-remote-code- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 上下文
- 1M
- 国内可达
- 需代理
当前运行配置
pyannote/speaker-diarization-community-1- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 缺少可用的显存依据
- 国内可达
- 需代理
当前运行配置
openai-community/gpt2- 显存
- 暂无估算
查看详情查看运行方式
vllm serve openai-community/gpt2- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- MIT
- 上下文
- 1024
- 国内可达
- 需代理
当前运行配置
lmstudio-community/granite-4.2-3b-MLX-6bit- 显存
- 暂无估算
查看详情查看运行方式
mlx_lm.generate --model lmstudio-community/granite-4.2-3b-MLX-6bit- 为何暂无估算
- 已有格式线索,但估算映射未支持,无法估算显存
- 许可证
- apache-2.0
- 国内可达
- 需代理
当前运行配置
ISTA-DASLab/Qwen3.8-27B-GSQ-RCO-GGUF- 显存
- 暂无估算
查看详情查看运行方式
ollama run hf.co/ISTA-DASLab/Qwen3.8-27B-GSQ-RCO-GGUF- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 国内可达
- 需代理
当前运行配置
Youssofal/Qwen3.8-27B-MTPLX-Bare-Speed- 显存
- ~16GB 4-bit(估算)
查看详情查看运行方式
mlx_lm.generate --model Youssofal/Qwen3.8-27B-MTPLX-Bare-Speed- 许可证
- Apache-2.0
- 上下文
- 262k
- 国内可达
- 需代理
当前运行配置
Youssofal/Qwen3.8-27B-MTPLX-Optimized-Quality- 显存
- ~30GB 8-bit(估算)
查看详情查看运行方式
mtplx serve --model Youssofal/Qwen3.8-27B-MTPLX-Optimized-Quality- 许可证
- Apache-2.0
- 上下文
- 262k
- 国内可达
- 需代理
当前运行配置
DavidAU/Qwen3.8-27B-TURBO-Fable-Cold-Fusion-735-882-Heretic-Uncensored-NEO-CODER-MAX-MTP-GGUF- 显存
- ~57GB BF16(估算)
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 许可证
- apache-2.0
- 上下文
- 256k
- 国内可达
- 需代理
当前运行配置
OpenVDN/vdn-minimax-h3- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 缺少可用的显存依据
- 许可证
- MiniMax H3 Community License Agreement(排除 EU/UK/KR/US)
- 国内可达
- 需代理
当前运行配置
sentence-transformers/all-MiniLM-L6-v2- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 上下文
- 256 word pieces
- 国内可达
- 需代理
当前运行配置
Youssofal/Qwen3.8-Flash-Next-MTPLX-Optimized-Speed- 显存
- ~75GB 4-bit(估算)
查看详情查看运行方式
mtplx serve --model Youssofal/Qwen3.8-Flash-Next-MTPLX-Optimized-Speed- 许可证
- qwen-community-1.0
- 上下文
- 262k
- 国内可达
- 需代理
当前运行配置
lmstudio-community/granite-4.2-8b-MLX-6bit- 显存
- 暂无估算
查看详情查看运行方式
mlx_lm.generate --model lmstudio-community/granite-4.2-8b-MLX-6bit- 为何暂无估算
- 已有格式线索,但估算映射未支持,无法估算显存
- 许可证
- apache-2.0
- 国内可达
- 需代理
当前运行配置
FastVideo/FastVideo-FastH3-4-step-Preview-v1-VSA-DataFree- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- MiniMax H3 Community License
- 国内可达
- 需代理
当前运行配置
incoai/GLM-5.3-Flash-DFlash2- 显存
- 暂无估算
查看详情查看运行方式
sglang serve --model-path zai-org/GLM-5.3-Flash --trust-remote-code --speculative-algorithm DFLASH --speculative-draft-model-path incoai/GLM-5.3-Flash-DFlash2 --speculative-draft-attention-backend fa4- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- CC BY-NC-ND 4.0
- 国内可达
- 需代理
当前运行配置
lmstudio-community/granite-4.2-30b-MLX-6bit- 显存
- 暂无估算
查看详情查看运行方式
mlx_lm.generate --model lmstudio-community/granite-4.2-30b-MLX-6bit --prompt "Hello"- 为何暂无估算
- 已有格式线索,但估算映射未支持,无法估算显存
- 许可证
- apache-2.0
- 国内可达
- 需代理
当前运行配置
lmstudio-community/granite-4.2-3b-MLX-8bit- 显存
- ~3.3GB 8-bit(估算)
查看详情查看运行方式
mlx_lm.generate --model lmstudio-community/granite-4.2-3b-MLX-8bit- 许可证
- apache-2.0
- 国内可达
- 需代理
- 其它形态
- 8bit · GGUF · 4bit
当前运行配置
pipecat-ai/phonellm-alpha-1- 显存
- 暂无估算
查看详情查看运行方式
vllm serve pipecat-ai/phonellm-alpha-1 --trust-remote-code- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- BSD-2-Clause(含 NVIDIA Nemotron Open Model License)
- 上下文
- 262k
- 国内可达
- 需代理
当前运行配置
lmstudio-community/Qwen3.8-Flash-Next-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf lmstudio-community/Qwen3.8-Flash-Next-GGUF- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- other
- 国内可达
- 需代理
当前运行配置
orcarouter/Qwen3.8-Flash-Next-Uncensored-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf orcarouter/Qwen3.8-Flash-Next-Uncensored-GGUF- 为何暂无估算
- 权重格式未知,无法估算显存
- 国内可达
- 需代理
当前运行配置
apodex/Apodex-1.1-mini- 显存
- 暂无估算
查看详情查看运行方式
vllm serve apodex/Apodex-1.1-mini --max-model-len 262144 --enable-auto-tool-choice --tool-call-parser qwen3_coder --reasoning-parser qwen3- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 262144
- 国内可达
- 需代理
当前运行配置
ibm-granite/granite-4.2-30b- 显存
- 暂无估算
查看详情查看运行方式
vllm serve ibm-granite/granite-4.2-30b- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 128K (可扩展 512K)
- 国内可达
- 需代理
- 其它形态
- 原生 · GGUF · 4bit · 8bit
本档靠
lmstudio-community/granite-4.2-30b-MLX-4bit(4bit)- 显存
- ~18GB 4-bit(估算)
下方显存与命令都属于这个配置
查看详情查看运行方式
mlx_lm.generate --model lmstudio-community/granite-4.2-30b-MLX-4bit- 许可证
- Apache-2.0
- 上下文
- 128K (可扩展 512K)
- 国内可达
- 需代理
- 其它形态
- 原生 · GGUF · 4bit · 8bit
当前运行配置
lmstudio-community/granite-4.2-8b-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf lmstudio-community/granite-4.2-8b-GGUF- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 国内可达
- 需代理
- 其它形态
- GGUF · 4bit · 8bit
本档靠
lmstudio-community/granite-4.2-8b-MLX-4bit(4bit)- 显存
- ~4.8GB 4-bit(估算)
下方显存与命令都属于这个配置
查看详情查看运行方式
mlx_lm.generate --model lmstudio-community/granite-4.2-8b-MLX-4bit --prompt 'Hello'- 许可证
- apache-2.0
- 国内可达
- 需代理
- 其它形态
- GGUF · 4bit · 8bit
本档靠
lmstudio-community/granite-4.2-8b-MLX-4bit(4bit)- 显存
- ~4.8GB 4-bit(估算)
下方显存与命令都属于这个配置
查看详情查看运行方式
mlx_lm.generate --model lmstudio-community/granite-4.2-8b-MLX-4bit --prompt 'Hello'- 许可证
- apache-2.0
- 国内可达
- 需代理
- 其它形态
- GGUF · 4bit · 8bit
本档靠
lmstudio-community/granite-4.2-8b-MLX-4bit(4bit)- 显存
- ~4.8GB 4-bit(估算)
下方显存与命令都属于这个配置
查看详情查看运行方式
mlx_lm.generate --model lmstudio-community/granite-4.2-8b-MLX-4bit --prompt 'Hello'- 许可证
- apache-2.0
- 国内可达
- 需代理
- 其它形态
- GGUF · 4bit · 8bit
当前运行配置
joeygambino/MiniMax-H3-x-Z-Image-native- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 缺少可用的显存依据
- 许可证
- minimax-h3-community-license
- 国内可达
- 需代理
当前运行配置
Youssofal/Qwen3.8-27B-MTPLX-Optimized-Speed- 显存
- ~16GB 4-bit(估算)
查看详情查看运行方式
mtplx serve --model Youssofal/Qwen3.8-27B-MTPLX-Optimized-Speed- 许可证
- apache-2.0
- 上下文
- 262k
- 国内可达
- 需代理
当前运行配置
peculiar-ragdoll/Tiel-Coder-35B-A3B-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf peculiar-ragdoll/Tiel-Coder-35B-A3B-GGUF --hf-file Tiel-Coder-35B-A3B-UD-Q4_K_XL.gguf -ngl 99 --jinja- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- MIT
- 国内可达
- 需代理
当前运行配置
tencent/WeMM-Embedding-9B- 显存
- 暂无估算
查看详情查看运行方式
vllm serve tencent/WeMM-Embedding-9B --runner pooling- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 国内可达
- 需代理
当前运行配置
BreezeBlue/Breeze-TTS-2- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- 研究/非商业许可;代码 Apache-2.0
- 语言
- 英文 / 中文
- 国内可达
- 需代理
当前运行配置
alibaba-pai/MiniMax-H3-Acc-LoRAs- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 缺少可用的显存依据
- 许可证
- apache-2.0
- 上下文
- 不适用
- 国内可达
- 需代理
从 Qwen3.8-27B 切割的 MoE,24GB 本地对话/代码
- 参数量
- 27B (17.8B active)
- 商用
- 可商用
当前运行配置
logic65/Qwen3.8-Whittle-MoE-27B-A17.8B- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf logic65/Qwen3.8-Whittle-MoE-27B-A17.8B -ngl 99 -c 8192 --jinja- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 上下文
- 8k
- 国内可达
- 需代理
当前运行配置
mvp-lab/MiniMax-H3-RAVEN-Streaming-LoRA- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 缺少可用的显存依据
- 许可证
- MiniMax-H3 Community License Agreement
- 国内可达
- 需代理
当前运行配置
peculiar-ragdoll/Dirk-Qwen3.8-27B-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf peculiar-ragdoll/Dirk-Qwen3.8-27B-GGUF:Q4_K_XL -ngl 99- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 国内可达
- 需代理
当前运行配置
alibaba-pai/MiniMax-H3-Fun-Controlnet-Union- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 缺少可用的显存依据
- 许可证
- MiniMax-H3 Community License Agreement
- 国内可达
- 需代理
当前运行配置
Audio8/Audio8-TTS-Preview-0.1b- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Audio8 Community License v1.0
- 上下文
- 2048
- 语言
- 中文(主) · 英文(主) · 德 / 西 / 法 / 意 / 日 / 韩
- 国内可达
- 需代理
当前运行配置
PoopMan333/H3_Character_Sheet_Generator- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 缺少可用的显存依据
- 许可证
- minimax-h3-community-license (EU/UK/韩国/美国除外)
- 国内可达
- 需代理
当前运行配置
z-lab/Qwen3.8-27B-DFlash2- 显存
- 暂无估算
查看详情查看运行方式
vllm serve Qwen/Qwen3.8-27B --speculative-config '{"method":"dflash","model":"z-lab/Qwen3.8-27B-DFlash2","num_speculative_tokens":7}'- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 上下文
- 128k
- 国内可达
- 需代理
- 其它形态
- 原生·z-lab · 原生·incoai · GGUF·incoai · GGUF·z-lab
当前运行配置
EschaLabs/Qwen3.8-27B-Escha-W2- 显存
- ~9.2GB 2-bit(估算)
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 许可证
- Apache-2.0
- 上下文
- 128k
- 国内可达
- 需代理
当前运行配置
ornith-ai/Ornith-1.5-35B-A3B- 显存
- 暂无估算
查看详情查看运行方式
vllm serve ornith-ai/Ornith-1.5-35B-A3B --trust-remote-code --reasoning-parser qwen3 --tool-call-parser qwen3_xml --enable-auto-tool-choice- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- MIT
- 上下文
- 262k
- 国内可达
- 需代理
- 其它形态
- 原生 · GGUF
当前运行配置
superwhisper/s1-mini- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf superwhisper/s1-mini-GGUF:Q4_K_M --jinja --chat-template-kwargs '{"enable_thinking":false}' --temp 0- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache 2.0 + 命名条款
- 国内可达
- 需代理
当前运行配置
peculiar-ragdoll/Dagger-Qwen3.6-27B-MLX- 显存
- 暂无估算
查看详情查看运行方式
mlx_lm.generate --model peculiar-ragdoll/Dagger-Qwen3.6-27B-MLX- 为何暂无估算
- 已有格式线索,但估算映射未支持,无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 256k
- 国内可达
- 需代理
当前运行配置
LiquidAI/LFM2.5-8B-A1B-DSpark-GGUF- 显存
- 暂无估算
查看详情查看运行方式
ollama run hf.co/LiquidAI/LFM2.5-8B-A1B-DSpark-GGUF- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- other (lfm1.0)
- 国内可达
- 需代理
当前运行配置
ornith-ai/Ornith-1.5-9B- 显存
- 暂无估算
查看详情查看运行方式
vllm serve ornith-ai/Ornith-1.5-9B --served-model-name Ornith-1.5-9B --max-model-len 262144 --enable-auto-tool-choice --tool-call-parser qwen3_xml --reasoning-parser qwen3 --trust-remote-code- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- MIT
- 上下文
- 262k(YaRN 可扩展至约 1M)
- 国内可达
- 需代理
- 其它形态
- 原生 · GGUF
当前运行配置
OBLITERATUS/Qwen3.8-27B-OBLITERATED- 显存
- 暂无估算
查看详情查看运行方式
ollama run hf.co/OBLITERATUS/Qwen3.8-27B-OBLITERATED- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 国内可达
- 需代理
当前运行配置
huihui-ai/Huihui-Qwen3.8-27B-abliterated-GGUF- 显存
- 暂无估算
查看详情查看运行方式
ollama run huihui_ai/Qwen3.8-abliterated- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 上下文
- 262k
- 国内可达
- 需代理
当前运行配置
DavidAU/Qwen3.8-27B-Cold-Fusion-GAIN-V1.1-NM-DAU-NEO-MAX-MTP-GGUF- 显存
- ~57GB BF16(估算)
查看详情查看运行方式
llama-server -hf DavidAU/Qwen3.8-27B-Cold-Fusion-GAIN-V1.1-NM-DAU-NEO-MAX-MTP-GGUF- 许可证
- Apache-2.0
- 上下文
- 256k
- 国内可达
- 需代理
当前运行配置
orcarouter/Qwen3.8-27B-Uncensored-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf orcarouter/Qwen3.8-27B-Uncensored-GGUF- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 262k
- 国内可达
- 需代理
- 其它形态
- GGUF·orcarouter · GGUF·jonathancoletti
当前运行配置
HauhauCS/Qwen3.8-27B-Uncensored-HauhauCS-Aggressive-MTP-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf HauhauCS/Qwen3.8-27B-Uncensored-HauhauCS-Aggressive-MTP-GGUF --jinja- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 262k 原生
- 国内可达
- 需代理
当前运行配置
empero-ai/Qwen3.8-9B-Distill- 显存
- 暂无估算
查看详情查看运行方式
vllm serve empero-ai/Qwen3.8-9B-Distill- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 262k
- 国内可达
- 需代理
- 其它形态
- 原生 · GGUF
当前运行配置
lmstudio-community/Qwen3.8-27B-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf lmstudio-community/Qwen3.8-27B-GGUF- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 上下文
- 262k
- 国内可达
- 需代理
- 其它形态
- GGUF·lmstudio · GGUF·atomicchat · GGUF·unsloth
当前运行配置
empero-ai/Qwen3.8-9B- 显存
- 暂无估算
查看详情查看运行方式
vllm serve empero-ai/Qwen3.8-9B- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 262k
- 国内可达
- 需代理
当前运行配置
HamoAI/hamo-score-0.6b- 显存
- 暂无估算
查看详情查看运行方式
ollama run hf.co/HamoAI/hamo-score-0.6b- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- HAMO-RAIL-S 1.0
- 国内可达
- 需代理
当前运行配置
VertexAIco/amethyst-1-mini- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf VertexAIco/amethyst-1-mini- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Gemma Terms of Use
- 上下文
- 1024
- 国内可达
- 需代理
当前运行配置
Blackfrost-AI/Qwen3.8-27B-ABLITERATED-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf Blackfrost-AI/Qwen3.8-27B-ABLITERATED-GGUF:Q4_K_M -ngl 999 --jinja -c 16384- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 262k
- 国内可达
- 需代理
当前运行配置
empero-ai/Qwen3.8-27B-Ridge-GGUF- 显存
- 暂无估算
查看详情查看运行方式
ollama run hf.co/empero-ai/Qwen3.8-27B-Ridge-GGUF- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 262k / YaRN 1M
- 国内可达
- 需代理
当前运行配置
HauhauCS/Qwen3.6-27B-Uncensored-HauhauCS-Aggressive- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf HauhauCS/Qwen3.6-27B-Uncensored-HauhauCS-Aggressive --jinja -c 131072 -ngl 99- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 262k(可扩展至 ~1M)
- 国内可达
- 需代理
当前运行配置
lmstudio-community/LFM2.5-2.6B-MLX-5bit- 显存
- 暂无估算
查看详情查看运行方式
mlx_lm.generate --model lmstudio-community/LFM2.5-2.6B-MLX-5bit- 为何暂无估算
- 已有格式线索,但估算映射未支持,无法估算显存
- 许可证
- LFM Open License v1.0
- 国内可达
- 需代理
当前运行配置
IndexTeam/IndexTTS-2.5- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- bilibili-model-license
- 语言
- 中文 / 英文 / 日语 / 西班牙语 / 阿拉伯语
- 国内可达
- 魔搭可用
当前运行配置
DeepBeepMeep/MiniMax-H3- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- MiniMax H3 Community License (有地域限制)
- 上下文
- 不适用
- 国内可达
- 需代理
- 其它形态
- 原生 · GGUF·abiray · GGUF·unsloth
当前运行配置
lmstudio-community/Muse-Glimmer-30B-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf lmstudio-community/Muse-Glimmer-30B-GGUF- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache 2.0
- 上下文
- 128k+
- 国内可达
- 需代理
- 其它形态
- GGUF·lmstudio · GGUF·meta-models · GGUF·unsloth
当前运行配置
nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16- 显存
- ~63GB BF16(估算)
查看详情查看运行方式
vllm serve nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16- 许可证
- OpenMDW-1.1
- 上下文
- 1M
- 国内可达
- 需代理
- 其它形态
- 原生 · GGUF
当前运行配置
MonsterMMORPG/Wan_GGUF- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 国内可达
- 需代理
当前运行配置
Gazingstars123/Anima-2.9B- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- CircleStone Labs Non-Commercial License
- 国内可达
- 需代理
当前运行配置
NicoLab28/ClipProj-MiniMax-H3- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- MIT(投影矩阵);基座模型 Apache 2.0 / MiniMax 自定义许可
- 国内可达
- 需代理
当前运行配置
Cactus-Compute/needle2- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 上下文
- 256 tokens
- 国内可达
- 需代理
当前运行配置
fal/MiniMax-H3-Realism-People-LoRA- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 缺少可用的显存依据
- 许可证
- minimax-h3-community-license
- 国内可达
- 需代理
当前运行配置
nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4- 显存
- 暂无估算
查看详情查看运行方式
vllm serve nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4- 为何暂无估算
- 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
- 许可证
- OpenMDW-1.1
- 上下文
- 1M
- 国内可达
- 需代理
当前运行配置
lmstudio-community/LFM2.5-2.6B-MLX-6bit- 显存
- 暂无估算
查看详情查看运行方式
mlx_lm.generate --model lmstudio-community/LFM2.5-2.6B-MLX-6bit- 为何暂无估算
- 已有格式线索,但估算映射未支持,无法估算显存
- 许可证
- LFM-1.0
- 国内可达
- 需代理
当前运行配置
Scrappy-Doo/GLM-5.2- 显存
- 暂无估算
查看详情查看运行方式
vllm serve Scrappy-Doo/GLM-5.2 --trust-remote-code- 为何暂无估算
- 缺少可用的参数量依据,无法估算显存
- 许可证
- MIT
- 上下文
- 1M
- 国内可达
- 需代理
- 其它形态
- 原生·scrappy-doo · GGUF · 原生·zai-org
当前运行配置
Nanbeige/Nanbeige4.2-3B- 显存
- 暂无估算
查看详情查看运行方式
ollama run nanbeige/nanbeige4.2:3b-Q4_K_M- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache 2.0
- 上下文
- 131k
- 国内可达
- 需代理
- 其它形态
- 原生 · GGUF
当前运行配置
LiquidAI/LFM2.5-2.6B- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf LiquidAI/LFM2.5-2.6B-GGUF- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- LFM Open License v1.0
- 上下文
- 128k
- 国内可达
- 需代理
- 其它形态
- 原生 · GGUF·liquidai · GGUF·lmstudio · 4bit · 8bit
本档靠
lmstudio-community/LFM2.5-2.6B-MLX-4bit(4bit)- 显存
- ~1.6GB 4-bit(估算)
下方显存与命令都属于这个配置
查看详情查看运行方式
mlx_lm.generate --model lmstudio-community/LFM2.5-2.6B-MLX-4bit- 许可证
- LFM Open License v1.0
- 上下文
- 128k
- 国内可达
- 需代理
- 其它形态
- 原生 · GGUF·liquidai · GGUF·lmstudio · 4bit · 8bit
本档靠
lmstudio-community/LFM2.5-2.6B-MLX-4bit(4bit)- 显存
- ~1.6GB 4-bit(估算)
下方显存与命令都属于这个配置
查看详情查看运行方式
mlx_lm.generate --model lmstudio-community/LFM2.5-2.6B-MLX-4bit- 许可证
- LFM Open License v1.0
- 上下文
- 128k
- 国内可达
- 需代理
- 其它形态
- 原生 · GGUF·liquidai · GGUF·lmstudio · 4bit · 8bit
本档靠
lmstudio-community/LFM2.5-2.6B-MLX-4bit(4bit)- 显存
- ~1.6GB 4-bit(估算)
下方显存与命令都属于这个配置
查看详情查看运行方式
mlx_lm.generate --model lmstudio-community/LFM2.5-2.6B-MLX-4bit- 许可证
- LFM Open License v1.0
- 上下文
- 128k
- 国内可达
- 需代理
- 其它形态
- 原生 · GGUF·liquidai · GGUF·lmstudio · 4bit · 8bit
当前运行配置
AutomatosX/AX-Qwen3.6-35B-A3B-MLX-AXQ-6bit-MTP- 显存
- 暂无估算
查看详情查看运行方式
mlx_lm.generate --model AutomatosX/AX-Qwen3.6-35B-A3B-MLX-AXQ-6bit-MTP- 为何暂无估算
- 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 262k
- 国内可达
- 需代理
当前运行配置
badtheorylabs/BTL-4- 显存
- 暂无估算
查看详情查看运行方式
vllm serve badtheorylabs/BTL-4 --max-model-len 131072 --enable-auto-tool-choice --tool-call-parser qwen3_xml --reasoning-parser qwen3 --trust-remote-code- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache 2.0
- 上下文
- 262k
- 国内可达
- 需代理
当前运行配置
Alissonerdx/CharacterSheet- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 缺少可用的显存依据
- 许可证
- Civitai 模型许可
- 上下文
- 不适用
- 国内可达
- 需代理
当前运行配置
deepgrove/maple-preview- 显存
- ~5.4GB ternary(估算)
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 许可证
- MIT
- 上下文
- 131k
- 国内可达
- 需代理
当前运行配置
lmstudio-community/Ornith-1.0-9B-MLX-5bit- 显存
- 暂无估算
查看详情查看运行方式
mlx_lm.generate --model lmstudio-community/Ornith-1.0-9B-MLX-5bit- 为何暂无估算
- 已有格式线索,但估算映射未支持,无法估算显存
- 许可证
- MIT
- 国内可达
- 需代理
当前运行配置
Akahsizrr/fuse-1-Lite- 显存
- 暂无估算
查看详情查看运行方式
mlx_lm.generate --model Akahsizrr/fuse-1-Lite-MLX --trust-remote-code- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache 2.0
- 国内可达
- 需代理
当前运行配置
realrebelai/MiniMax-H3_GGUFs- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 国内可达
- 需代理
当前运行配置
drbaph/MiniMax-H3-Turbo-Lora-ComfyUI- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 缺少可用的显存依据
- 许可证
- apache-2.0
- 国内可达
- 需代理
当前运行配置
larryvrh/MiniMax-H3-Turbo-Lora- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 缺少可用的显存依据
- 许可证
- apache-2.0
- 国内可达
- 需代理
当前运行配置
BAAI/bge-m3- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 缺少可用的参数量依据,无法估算显存
- 许可证
- MIT
- 上下文
- 8192
- 国内可达
- 需代理
当前运行配置
lodestones/Kroma- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 缺少可用的显存依据
- 许可证
- MIT
- 国内可达
- 需代理
当前运行配置
meta-llama/Llama-3.1-8B-Instruct- 显存
- 暂无估算
查看详情查看运行方式
ollama run hf.co/meta-llama/Llama-3.1-8B-Instruct- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Llama 3.1 Community License
- 上下文
- 128k
- 国内可达
- 需代理
当前运行配置
Qwen/Qwen2.5-7B-Instruct- 显存
- 暂无估算
查看详情查看运行方式
vllm serve Qwen/Qwen2.5-7B-Instruct- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 128k
- 国内可达
- 需代理
当前运行配置
ManniX-ITA/Qwen3.6-27B-Omnimerge-v4-MTP-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf ManniX-ITA/Qwen3.6-27B-Omnimerge-v4-MTP-GGUF -m Qwen3.6-27B-Omnimerge-v4-Q6_K.gguf --spec-type draft-mtp --spec-draft-n-max 3 -ngl 99 -c 16384- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 上下文
- 128k
- 国内可达
- 需代理
当前运行配置
LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V7-GGUF- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 上下文
- 262K (可扩至1M)
- 国内可达
- 需代理
当前运行配置
openai/whisper-large-v3- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache 2.0
- 上下文
- 30s 音频
- 国内可达
- 需代理
- 其它形态
- 原生 · MLX
当前运行配置
antirez/deepseek-v4-gguf- 显存
- 暂无估算
查看详情查看运行方式
ollama run hf.co/antirez/deepseek-v4-gguf- 为何暂无估算
- 缺少可用的参数量依据,无法估算显存
- 许可证
- MIT
- 上下文
- 100k
- 国内可达
- 需代理
当前运行配置
thunkaboutit/Koleslaw-Nemotron-30B-A3B-PromptEnhance- 显存
- 暂无估算
查看详情查看运行方式
ollama run hf.co/thunkaboutit/Koleslaw-Nemotron-30B-A3B-PromptEnhance- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- NVIDIA Nemotron Open Model License
- 上下文
- 8K
- 国内可达
- 需代理
当前运行配置
lmstudio-community/Ornith-1.0-35B-MLX-6bit- 显存
- 暂无估算
查看详情查看运行方式
mlx_lm.generate --model lmstudio-community/Ornith-1.0-35B-MLX-6bit- 为何暂无估算
- 已有格式线索,但估算映射未支持,无法估算显存
- 许可证
- MIT
- 国内可达
- 需代理
当前运行配置
lmstudio-community/Ornith-1.0-9B-MLX-6bit- 显存
- 暂无估算
查看详情查看运行方式
mlx_lm.generate --model lmstudio-community/Ornith-1.0-9B-MLX-6bit- 为何暂无估算
- 已有格式线索,但估算映射未支持,无法估算显存
- 许可证
- MIT
- 国内可达
- 需代理
当前运行配置
fishaudio/s2-pro- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- fish-audio-research-license
- 语言
- 日 / 英 / 中 (主) · 韩 / 西 / 葡 / 阿 / 俄 / 法 / 德等80+语言
- 国内可达
- 需代理
当前运行配置
meituan-longcat/LongCat-Flash-Lite-Sparse- 显存
- 暂无估算
查看详情查看运行方式
python3 -m sglang.launch_server --model meituan-longcat/LongCat-Flash-Lite-Sparse --trust-remote-code --chunked-prefill-size 2048 --nsa-prefill-backend fa3 --kv-cache-dtype bfloat16- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- MIT
- 上下文
- 1M
- 国内可达
- 需代理
当前运行配置
deepreinforce-ai/Ornith-1.0-35B- 显存
- 暂无估算
本档靠
lmstudio-community/Ornith-1.0-35B-MLX-4bit(4bit)- 显存
- ~21GB 4-bit(估算)
下方显存与命令都属于这个配置
查看详情查看运行方式
mlx_lm.generate --model lmstudio-community/Ornith-1.0-35B-MLX-4bit- 许可证
- mit
- 上下文
- 256k
- 国内可达
- 需代理
- 其它形态
- 原生 · FP8 · GGUF·deepreinforce-ai · GGUF·lmstudio · 4bit · 8bit · GGUF·unsloth
当前运行配置
lmstudio-community/Ornith-1.0-35B-MLX-5bit- 显存
- 暂无估算
查看详情查看运行方式
mlx_lm.generate --model lmstudio-community/Ornith-1.0-35B-MLX-5bit- 为何暂无估算
- 已有格式线索,但估算映射未支持,无法估算显存
- 许可证
- mit
- 国内可达
- 需代理
当前运行配置
deepreinforce-ai/Ornith-1.0-9B- 显存
- 暂无估算
本档靠
lmstudio-community/Ornith-1.0-9B-MLX-4bit(4bit)- 显存
- ~5.4GB 4-bit(估算)
下方显存与命令都属于这个配置
查看详情查看运行方式
mlx_lm.generate --model lmstudio-community/Ornith-1.0-9B-MLX-4bit- 许可证
- mit
- 上下文
- 256k
- 国内可达
- 需代理
- 其它形态
- 原生 · GGUF·deepreinforce-ai · GGUF·lmstudio · 4bit · 8bit · GGUF·protolabsai
本档靠
lmstudio-community/Ornith-1.0-9B-MLX-4bit(4bit)- 显存
- ~5.4GB 4-bit(估算)
下方显存与命令都属于这个配置
查看详情查看运行方式
mlx_lm.generate --model lmstudio-community/Ornith-1.0-9B-MLX-4bit- 许可证
- mit
- 上下文
- 256k
- 国内可达
- 需代理
- 其它形态
- 原生 · GGUF·deepreinforce-ai · GGUF·lmstudio · 4bit · 8bit · GGUF·protolabsai
本档靠
lmstudio-community/Ornith-1.0-9B-MLX-4bit(4bit)- 显存
- ~5.4GB 4-bit(估算)
下方显存与命令都属于这个配置
查看详情查看运行方式
mlx_lm.generate --model lmstudio-community/Ornith-1.0-9B-MLX-4bit- 许可证
- mit
- 上下文
- 256k
- 国内可达
- 需代理
- 其它形态
- 原生 · GGUF·deepreinforce-ai · GGUF·lmstudio · 4bit · 8bit · GGUF·protolabsai
当前运行配置
lmstudio-community/DeepSeek-V4-Flash-0731-GGUF- 显存
- 暂无估算
查看详情查看运行方式
ollama run hf.co/lmstudio-community/DeepSeek-V4-Flash-0731-GGUF- 为何暂无估算
- 缺少可用的参数量依据,无法估算显存
- 许可证
- MIT
- 国内可达
- 需代理
- 其它形态
- GGUF·lmstudio · GGUF·unsloth
当前运行配置
unsloth/Inkling-Small-GGUF- 显存
- 暂无估算
查看详情查看运行方式
ollama run hf.co/unsloth/Inkling-Small-GGUF- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 国内可达
- 需代理
当前运行配置
inference-optimization/Kimi-K3-0.40B- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- MIT
- 国内可达
- 需代理
当前运行配置
Audio8/Audio8-TTS-Preview-0.6b- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 2048
- 语言
- 粤语 / 中文 / 荷兰语 / 英语 / 法语 / 德语 / 意大利语 / 日语 / 韩语 / 波兰语 / 西班牙语
- 国内可达
- 需代理
当前运行配置
nyralabs/CrisperWhisper2.0_large- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- 非商业研究许可
- 上下文
- 30s音频窗口,长音频自动拼接
- 国内可达
- 需代理
当前运行配置
mindlab-research/Macaron-V1-Tall- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- MIT
- 上下文
- 262k
- 国内可达
- 需代理
当前运行配置
EschaLabs/Qwen3.6-35B-A3B-Escha-W2- 显存
- ~12GB 2-bit(估算)
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 许可证
- Apache-2.0
- 上下文
- 128k
- 国内可达
- 需代理
当前运行配置
Nanthasit/sakthai-tts-model- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- MIT (包装) / Apache 2.0 (Kokoro)
- 上下文
- 不适用
- 语言
- 英/日/中/韩/法/西/葡/意/德/波/俄/阿/印/孟/泰
- 国内可达
- 需代理
当前运行配置
XYZAILab/XYZ-Aquila-mini- 显存
- 暂无估算
查看详情查看运行方式
python -m sglang.launch_server --model-path XYZAILab/XYZ-Aquila-mini --reasoning-parser qwen3 --tool-call-parser qwen3_coder- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache 2.0
- 上下文
- 256k
- 国内可达
- 魔搭可用
Gemma 4 98e coder GGUF量化,本地代码生成与推理
- 参数量
- 20.8B (4B active MoE)
- 商用
- 限制商用
当前运行配置
ManniX-ITA/gemma-4-A4B-98e-v6-coder-it-GGUF- 显存
- 暂无估算
查看详情查看运行方式
ollama run mannix/gemma4-98e-v6-coder- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Gemma
- 上下文
- 32k
- 国内可达
- 需代理
当前运行配置
Nanthasit/sakthai-vision-7b- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- LLaMA 2 Community
- 上下文
- 4k
- 国内可达
- 需代理
当前运行配置
amd/Instella-MoE-16B-A3B-Think- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- ResearchRAIL
- 国内可达
- 需代理
当前运行配置
nvidia/Qwen-Image-Flash- 显存
- 暂无估算
查看详情查看运行方式
sglang generate --model-path nvidia/Qwen-Image-Flash --prompt "A red fox in a snowy pine forest at golden hour, photorealistic, sharp focus, soft bokeh" --width 1024 --height 1024 --num-inference-steps 4 --guidance-scale 1.0 --true-cfg-scale 1.0 --seed 42 --save-output --output-file-path qwen-image-flash-sglang.png- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- NVIDIA Open Model Agreement
- 国内可达
- 需代理
当前运行配置
LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V6-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V6-GGUF --jinja -ngl 99- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 上下文
- 262K
- 国内可达
- 需代理
当前运行配置
microsoft/VibeVoice-ASR-BitNet- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- MIT
- 国内可达
- 需代理
当前运行配置
owensong/Inflect-Nano-v2- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 上下文
- 不适用
- 语言
- 英文
- 国内可达
- 需代理
当前运行配置
Goekdeniz-Guelmez/JOSIE-2-4B-Preview- 显存
- 暂无估算
查看详情查看运行方式
mlx_lm.generate --model Goekdeniz-Guelmez/JOSIE-2-4B-Preview- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- MIT
- 国内可达
- 需代理
当前运行配置
gokhanturhan/CLINAMEN-Chat- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- MIT
- 国内可达
- 需代理
当前运行配置
owensong/Inflect-Micro-v2- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 无限制(标点分块)
- 语言
- 英文
- 国内可达
- 需代理
当前运行配置
poolside/Laguna-XS-2.1- 显存
- 暂无估算
查看详情查看运行方式
ollama run laguna-xs-2.1- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- openmdw-1.1
- 上下文
- 262k
- 国内可达
- 需代理
- 其它形态
- 原生 · GGUF
当前运行配置
microsoft/Mage-Flow-Turbo- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- MIT
- 上下文
- 不适用
- 国内可达
- 需代理
当前运行配置
ThingAI/Quak-50m-v2- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 2048
- 国内可达
- 需代理
当前运行配置
fdtn-ai/antares-1b- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 国内可达
- 需代理
直接生成可执行ELF hex的文本模型
- 参数量
- 约4.3B (基于F16.gguf 8.6GiB推断)
- 商用
- 可商用
当前运行配置
ProCreations/grug-27b- 显存
- 暂无估算
查看详情查看运行方式
vllm serve ProCreations/grug-27b --reasoning-parser qwen3 --max-model-len 32768- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 国内可达
- 需代理
当前运行配置
badtheorylabs/BTL-3- 显存
- 暂无估算
查看详情查看运行方式
vllm serve Qwen/Qwen3.6-27B --revision 6a9e13bd6fc8f0983b9b99948120bc37f49c13e9 --served-model-name BTL-3 --enable-lora --max-lora-rank 32 --lora-modules BTL-3=badtheorylabs/BTL-3 --lora-target-modules q_proj k_proj v_proj o_proj in_proj_qkv in_proj_z in_proj_b in_proj_a out_proj gate_proj up_proj down_proj --reasoning-parser qwen3 --language-model-only --max-model-len 32768- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 262k
- 国内可达
- 需代理
当前运行配置
mradermacher/Grok-3-reasoning-gemma3-4B-distilled-HF-GGUF- 显存
- 暂无估算
查看详情查看运行方式
ollama run hf.co/mradermacher/Grok-3-reasoning-gemma3-4B-distilled-HF-GGUF- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 国内可达
- 需代理
当前运行配置
poolside/Laguna-S-2.1-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf poolside/Laguna-S-2.1-GGUF -m laguna-s-2.1-Q4_K_M.gguf --jinja- 为何暂无估算
- 缺少可用的参数量依据,无法估算显存
- 许可证
- openmdw-1.1
- 上下文
- 256K
- 国内可达
- 需代理
- 其它形态
- GGUF·poolside · GGUF·lmstudio
当前运行配置
DavidAU/Qwen3.5-9B-The-Defiant-Fable-Uncensored-Heretic-NEO-IMATRIX-MAX-MTP-GGUF- 显存
- ~19GB BF16(估算)
查看详情查看运行方式
llama-server -hf DavidAU/Qwen3.5-9B-The-Defiant-Fable-Uncensored-Heretic-NEO-IMATRIX-MAX-MTP-GGUF- 许可证
- Apache 2.0
- 上下文
- 256k
- 国内可达
- 需代理
当前运行配置
Kwaipilot/KAT-Coder-V2.5-Dev- 显存
- 暂无估算
查看详情查看运行方式
vllm serve Kwaipilot/KAT-Coder-V2.5-Dev --language-model-only --reasoning-parser qwen3- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 上下文
- 256k
- 国内可达
- 需代理
当前运行配置
microsoft/Mage-Flow-Edit-Turbo- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- MIT
- 国内可达
- 需代理
当前运行配置
FINAL-Bench/POCKET-KR-MLX- 显存
- ~12GB 2-bit(估算)
查看详情查看运行方式
mlx_lm.generate --model FINAL-Bench/POCKET-KR-MLX- 许可证
- Apache-2.0
- 国内可达
- 需代理
无审查多模态 MoE,支持 Hermes 工具调用,为创作者
- 参数量
- 35B (激活 3B)
- 商用
- 可商用
当前运行配置
LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V5-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V5-GGUF --jinja- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 上下文
- 262K (可扩展至 1M)
- 国内可达
- 需代理
当前运行配置
poolside/Laguna-S-2.1-NVFP4- 显存
- 暂无估算
查看详情查看运行方式
vllm serve poolside/Laguna-S-2.1-NVFP4- 为何暂无估算
- 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
- 许可证
- OpenMDW-1.1
- 上下文
- 256K
- 国内可达
- 需代理
当前运行配置
microsoft/Mage-Flow- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- MIT
- 国内可达
- 需代理
当前运行配置
AtomicChat/ornith-35b-MLX-8bit- 显存
- ~39GB 8-bit(估算)
查看详情查看运行方式
mlx_lm.generate --model AtomicChat/ornith-35b-MLX-8bit --prompt Hello- 许可证
- MIT
- 上下文
- 256K
- 国内可达
- 需代理
当前运行配置
AtomicChat/ornith-35b-MLX-6bit- 显存
- 暂无估算
查看详情查看运行方式
mlx_lm.generate --model AtomicChat/ornith-35b-MLX-6bit --prompt 'Hello'- 为何暂无估算
- 已有格式线索,但估算映射未支持,无法估算显存
- 许可证
- MIT
- 上下文
- 256K
- 国内可达
- 需代理
当前运行配置
neureps/warmly-qwen35-08b-enko-gguf- 显存
- 暂无估算
查看详情查看运行方式
ollama run hf.co/neureps/warmly-qwen35-08b-enko-gguf- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 国内可达
- 需代理
当前运行配置
nineninesix/diamond-1.0- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 国内可达
- 需代理
当前运行配置
majentik/gpt-oss-20b-TurboQuant-MLX-2bit- 显存
- 暂无估算
查看详情查看运行方式
mlx_lm.generate --model majentik/gpt-oss-20b-TurboQuant-MLX-2bit --prompt '你的提示'- 为何暂无估算
- 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
- 许可证
- Apache 2.0
- 国内可达
- 需代理
当前运行配置
nvidia/Nemotron-3-Embed-1B-NVFP4- 显存
- 暂无估算
查看详情查看运行方式
vllm serve nvidia/Nemotron-3-Embed-1B-NVFP4- 为何暂无估算
- 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
- 许可证
- OpenMDW-1.1
- 上下文
- 32k
- 国内可达
- 需代理
当前运行配置
zak-raindog/gear-manual-qwen3-4b- 显存
- ~2.4GB 4-bit(估算)
查看详情查看运行方式
mlx_lm.generate --model zak-raindog/gear-manual-qwen3-4b --prompt "如何使用EP-133?"- 许可证
- cc-by-nc-4.0
- 国内可达
- 需代理
当前运行配置
nvidia/Nemotron-3-Embed-8B-BF16- 显存
- ~17GB BF16(估算)
查看详情查看运行方式
vllm serve nvidia/Nemotron-3-Embed-8B-BF16- 许可证
- OpenMDW-1.1
- 上下文
- 32768
- 国内可达
- 需代理
当前运行配置
DavidAU/Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF- 显存
- ~57GB BF16(估算)
查看详情查看运行方式
ollama run hf.co/DavidAU/Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF- 许可证
- Apache 2.0
- 上下文
- 256k
- 国内可达
- 需代理
无审查视觉 MoE 模型,Hermes 工具调用,GGUF 本地推理
- 参数量
- 35B (3B 激活)
- 商用
- 可商用
当前运行配置
LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF --jinja- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 262K (可扩展至 1M)
- 国内可达
- 需代理
当前运行配置
ai-sage/GigaAM-Multilingual- 显存
- 暂无估算
查看详情查看运行方式
python -c "from transformers import AutoModel; model=AutoModel.from_pretrained('ai-sage/GigaAM-Multilingual', revision='ctc', trust_remote_code=True); print(model.transcribe('example.wav'))"- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- mit
- 国内可达
- 需代理
- 其它形态
- 原生 · MLX
当前运行配置
ai-babai/gigaam-multilingual-mlx-int8-g64- 显存
- ~0.2GB 8-bit(估算)
查看详情查看运行方式
uvx gigaam-multilingual-mlx gigaam-stt <audio> --variant int8- 许可证
- MIT
- 国内可达
- 需代理
当前运行配置
ai-babai/gigaam-multilingual-mlx-int4-g64- 显存
- ~0.1GB 4-bit(估算)
查看详情查看运行方式
uv tool install gigaam-multilingual-mlx==0.2.0 && gigaam-stt audio.wav --variant int4- 许可证
- MIT
- 上下文
- 不适用
- 国内可达
- 需代理
当前运行配置
nvidia/Nemotron-3-Embed-1B-BF16- 显存
- ~2.4GB BF16(估算)
查看详情查看运行方式
vllm serve nvidia/Nemotron-3-Embed-1B-BF16- 许可证
- OpenMDW-1.1
- 上下文
- 32768
- 国内可达
- 需代理
当前运行配置
prism-ml/Bonsai-27B-mlx-1bit- 显存
- ~4.1GB 1-bit(估算)
查看详情查看运行方式
mlx_lm.generate --model prism-ml/Bonsai-27B-mlx-1bit- 许可证
- apache-2.0
- 上下文
- 262K
- 国内可达
- 需代理
当前运行配置
RavichandranJ/Dolphin3-Cyber-8B-GGUF- 显存
- 暂无估算
查看详情查看运行方式
ollama run hf.co/RavichandranJ/Dolphin3-Cyber-8B-GGUF- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- llama3.1
- 上下文
- 2k
- 国内可达
- 需代理
当前运行配置
fattis/FrickFritz-4B-GGUF- 显存
- 暂无估算
查看详情查看运行方式
ollama run hf.co/fattis/FrickFritz-4B-GGUF- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 国内可达
- 需代理
当前运行配置
alphaZimuth/Hy-MT2-30B-A3B-APEX-GGUF- 显存
- 暂无估算
查看详情查看运行方式
ollama run hf.co/alphaZimuth/Hy-MT2-30B-A3B-APEX-GGUF- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 国内可达
- 需代理
当前运行配置
AngelSlim/Hy3-GGUF- 显存
- 暂无估算
查看详情查看运行方式
ollama run hf.co/AngelSlim/Hy3-GGUF- 为何暂无估算
- 缺少可用的参数量依据,无法估算显存
- 许可证
- apache-2.0
- 上下文
- 65536
- 国内可达
- 魔搭可用
当前运行配置
GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking- 显存
- 暂无估算
查看详情查看运行方式
ollama run hf.co/GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 128k
- 国内可达
- 需代理
- 其它形态
- 原生 · GGUF
当前运行配置
Kutches/UncensoredV2- 显存
- 暂无估算
查看详情查看运行方式
vllm serve Kutches/UncensoredV2- 为何暂无估算
- 权重格式未知,无法估算显存
- 国内可达
- 需代理
当前运行配置
Darkhn-Quants-4/Gemma-4-31B-Animus-V15.0-GGUF- 显存
- 暂无估算
查看详情查看运行方式
ollama run hf.co/Darkhn-Quants-4/Gemma-4-31B-Animus-V15.0-GGUF- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 国内可达
- 需代理
当前运行配置
mlx-community/NVIDIA-Nemotron-3-Nano-30B-A3B-OptiQ-4bit- 显存
- 暂无估算
查看详情查看运行方式
mlx_lm.generate --model mlx-community/NVIDIA-Nemotron-3-Nano-30B-A3B-OptiQ-4bit- 为何暂无估算
- 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
- 许可证
- nvidia-open-model-license
- 国内可达
- 需代理
当前运行配置
mlx-community/Qwen3.5-35B-A3B-OptiQ-4bit- 显存
- 暂无估算
查看详情查看运行方式
mlx_lm.generate --model mlx-community/Qwen3.5-35B-A3B-OptiQ-4bit --prompt 'Explain quantum computing.' --max-tokens 200- 为何暂无估算
- 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
- 许可证
- apache-2.0
- 上下文
- 128k
- 国内可达
- 需代理
当前运行配置
prism-ml/Ternary-Bonsai-27B-mlx-2bit- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf prism-ml/Ternary-Bonsai-27B-gguf- 为何暂无估算
- 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
- 许可证
- apache-2.0
- 上下文
- 262k
- 国内可达
- 需代理
当前运行配置
aquaman164/Qwen3.6-35B-A3B-MLX-VQ-2.6bpw- 显存
- 暂无估算
查看详情查看运行方式
huggingface-cli download aquaman164/Qwen3.6-35B-A3B-MLX-VQ-2.6bpw --local-dir qwen-vq && python qwen-vq/code/vq_serve.py --model qwen-vq- 为何暂无估算
- 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 128k
- 国内可达
- 需代理
当前运行配置
mgwr/M87- 显存
- 暂无估算
查看详情查看运行方式
python -c "from diffusers import DiffusionPipeline; pipe = DiffusionPipeline.from_pretrained('krea/Krea-2-Turbo'); pipe.load_lora_weights('mgwr/M87'); pipe('a cat --preview').images[0].save('out.png')"- 为何暂无估算
- 缺少可用的显存依据
- 许可证
- apache-2.0
- 国内可达
- 需代理
当前运行配置
nathansutton/Ornith-1.0-35B-UD-Q2_K_XL-MLX- 显存
- ~12GB 2-bit(估算)
查看详情查看运行方式
uvx --from git+https://github.com/nathansutton/mlxcc chad- 国内可达
- 需代理
当前运行配置
mlx-community/Qwen3.5-9B-OptiQ-4bit- 显存
- 暂无估算
查看详情查看运行方式
mlx_lm.generate --model mlx-community/Qwen3.5-9B-OptiQ-4bit- 为何暂无估算
- 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
- 许可证
- apache-2.0
- 上下文
- 128k
- 国内可达
- 需代理
当前运行配置
empero-ai/Qwythos-9B-v2- 显存
- 暂无估算
查看详情查看运行方式
vllm serve empero-ai/Qwythos-9B-v2 --trust-remote-code- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 1048k
- 国内可达
- 需代理
- 其它形态
- 原生 · GGUF
当前运行配置
ostris/krea2_turbo_style_reference- 显存
- 暂无估算
查看详情查看运行方式
pipe = DiffusionPipeline.from_pretrained("krea/Krea-2-Turbo", custom_pipeline="ostris/Krea2OstrisEdit", torch_dtype=torch.bfloat16); pipe.enable_model_cpu_offload(); pipe.load_lora_weights("ostris/krea2_turbo_style_reference")- 为何暂无估算
- 缺少可用的显存依据
- 许可证
- krea-2-community-license
- 上下文
- 不适用
- 国内可达
- 需代理
当前运行配置
nvidia/Nemotron-Labs-Audex-2B- 显存
- 暂无估算
查看详情查看运行方式
python -c "from transformers import AutoModel; AutoModel.from_pretrained('nvidia/Nemotron-Labs-Audex-2B', trust_remote_code=True)"- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- NVIDIA OneWay Noncommercial License
- 上下文
- 128k
- 国内可达
- 需代理
当前运行配置
CohereLabs/cohere-transcribe-arabic-07-2026- 显存
- 暂无估算
查看详情查看运行方式
python -c "from transformers import pipeline; pipe = pipeline('automatic-speech-recognition', 'CohereLabs/cohere-transcribe-arabic-07-2026'); print(pipe('audio.wav'))"- 为何暂无估算
- 权重格式未知,无法估算显存
- 国内可达
- 需代理
当前运行配置
nineninesix/gepard-1.0- 显存
- 暂无估算
查看详情查看运行方式
vllm serve nineninesix/gepard-1.0- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache 2.0 (codec: NVIDIA Open Model License)
- 语言
- 英语(美/英) · 西班牙语(墨) · 葡萄牙语(巴西) · 荷兰语
- 国内可达
- 需代理
当前运行配置
fzcfweasdferttgg/Qwen3.6-27B-Claude-Opus-Reasoning-Distill-v2-heretic-GGUF- 显存
- 暂无估算
查看详情查看运行方式
ollama run hf.co/fzcfweasdferttgg/Qwen3.6-27B-Claude-Opus-Reasoning-Distill-v2-heretic-GGUF- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 上下文
- 256K
- 国内可达
- 需代理
当前运行配置
bottlecapai/ThinkingCap-Qwen3.6-27B-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf bottlecapai/ThinkingCap-Qwen3.6-27B-GGUF:Q4_K_M --mmproj bottlecapai/ThinkingCap-Qwen3.6-27B-GGUF:mmproj-ThinkingCap-Qwen3.6-27B-f16.gguf- 为何暂无估算
- 权重格式未知,无法估算显存
- 国内可达
- 需代理
当前运行配置
hexgrad/Kokoro-82M- 显存
- 暂无估算
查看详情查看运行方式
pip install kokoro && python -c "from kokoro import KPipeline; KPipeline('a'); print('Kokoro loaded')"- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 语言
- 8 种语言
- 国内可达
- 需代理
面向高吞吐推理的压缩 MoE 模型,用于交互式推理与高并发部署
- 参数量
- 75B (9.3B active)
- 商用
- 需自查
当前运行配置
nvidia/NVIDIA-Nemotron-Labs-3-Puzzle-75B-A9B-NVFP4- 显存
- 暂无估算
查看详情查看运行方式
vllm serve nvidia/NVIDIA-Nemotron-Labs-3-Puzzle-75B-A9B-NVFP4 --trust-remote-code --mamba-backend flashinfer- 为何暂无估算
- 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
- 许可证
- OpenMDW-1.1
- 上下文
- 1M
- 国内可达
- 需代理
当前运行配置
nvidia/Nemotron-Labs-Audex-30B-A3B- 显存
- 暂无估算
查看详情查看运行方式
python -c "from transformers import AutoModelForCausalLM; AutoModelForCausalLM.from_pretrained('nvidia/Nemotron-Labs-Audex-30B-A3B', trust_remote_code=True)"- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- NVIDIA Oneway Noncommercial License
- 上下文
- 1M
- 国内可达
- 需代理
当前运行配置
SupraLabs/Supra-Router-51M- 显存
- 暂无估算
查看详情查看运行方式
AutoModelForCausalLM.from_pretrained('SupraLabs/Supra-Router-51M')- 为何暂无估算
- 权重格式未知,无法估算显存
- 上下文
- 3840
- 国内可达
- 需代理
当前运行配置
Alissonerdx/LTX-Best-Face-ID- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- other
- 国内可达
- 需代理
当前运行配置
kai-os/Grug-12B- 显存
- 暂无估算
查看详情查看运行方式
ollama run hf.co/kai-os/Grug-12B- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- other
- 国内可达
- 需代理
当前运行配置
InternScience/Agents-A1- 显存
- 暂无估算
本档靠
InternScience/Agents-A1-Q4_K_M-GGUF(GGUF)- 显存
- ~21GB 4-bit(估算)
下方显存与命令都属于这个配置
查看详情查看运行方式
ollama run hf.co/InternScience/Agents-A1-Q4_K_M-GGUF- 许可证
- Apache 2.0
- 上下文
- 262k
- 国内可达
- 魔搭可用
- 其它形态
- 原生 · GGUF
当前运行配置
Patil/Krea-2-depth-controlnet- 显存
- 暂无估算
查看详情查看运行方式
git clone https://github.com/Tanmaypatil123/Krea-2-controlnet && cd Krea-2-controlnet && pip install -q -r requirements.txt && hf download Patil/Krea-2-depth-controlnet depth-control-lora.safetensors --local-dir . && python inference.py input.jpg -p "prompt" --lora depth-control-lora.safetensors- 为何暂无估算
- 缺少可用的显存依据
- 许可证
- krea-2-community-license
- 国内可达
- 需代理
当前运行配置
MaralGPT/MaralGPT-Mythos-9B-2606-GGUF- 显存
- 暂无估算
查看详情查看运行方式
ollama run hf.co/MaralGPT/MaralGPT-Mythos-9B-2606-GGUF- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 上下文
- 1M
- 国内可达
- 需代理
当前运行配置
Smilyai-labs/Nova-1-Standard-1.3B-Preview- 显存
- 暂无估算
查看详情查看运行方式
pipeline('text-generation', model='Smilyai-labs/Nova-1-Standard-1.3B-Preview', trust_remote_code=True, device_map='auto')- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 上下文
- 2048
- 国内可达
- 需代理
当前运行配置
manjunathshiva/Qwen3.6-35B-A3B-tq3a-tqTe-g64- 显存
- 暂无估算
查看详情查看运行方式
pip install 'turboquant-mlx-full>=0.12.3' && python -m turboquant_mlx.generate --model manjunathshiva/Qwen3.6-35B-A3B-tq3a-tqTe-g64- 为何暂无估算
- 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
- 许可证
- Apache-2.0
- 国内可达
- 需代理
当前运行配置
programasweights/paw-programs- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 缺少可用的参数量依据,无法估算显存
- 国内可达
- 需代理
当前运行配置
yuxinlu1/gemma-4-12B-agentic-fable5-composer2.5-v2-3.5x-tau2- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf yuxinlu1/gemma-4-12B-agentic-fable5-composer2.5-v2-3.5x-tau2-GGUF -ngl 99 --jinja- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 16k(示例命令)
- 国内可达
- 需代理
- 其它形态
- 原生 · GGUF
当前运行配置
ailexleon/Gemma4-Gutenberg-31B-Heretic-mlx-8Bit- 显存
- ~34GB 8-bit(估算)
查看详情查看运行方式
mlx_lm.generate --model ailexleon/Gemma4-Gutenberg-31B-Heretic-mlx-8Bit --prompt 'hello'- 许可证
- apache-2.0
- 国内可达
- 需代理
当前运行配置
eric-venti-seeds/Sun-Direction-Lora-Flux2Klein9B- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 不适用
- 国内可达
- 需代理
当前运行配置
HauhauCS/Gemma4-26B-A4B-QAT-Uncensored-HauhauCS-Balanced-MTP- 显存
- 暂无估算
查看详情查看运行方式
llama-server -m Gemma4-26B-A4B-QAT-Uncensored-HauhauCS-Balanced-Q4_K_M.gguf --mmproj mmproj-Gemma4-26B-A4B-QAT-Uncensored-HauhauCS-Balanced-BF16.gguf -md mtp-gemma-4-26B-A4B-it.gguf --spec-type draft-mtp -ngl 99 -fa on (需下载3个文件)- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- gemma
- 上下文
- 256k
- 国内可达
- 需代理
当前运行配置
huihui-ai/Huihui-Qwythos-9B-Claude-Mythos-5-1M-abliterated-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama-cli -hf huihui-ai/Huihui-Qwythos-9B-Claude-Mythos-5-1M-abliterated-GGUF --model Huihui-Qwythos-9B-Claude-Mythos-5-1M-abliterated-Q4_K.gguf -ngl 99 -c 262144 -fa on -np 1 --spec-type draft-mtp --spec-draft-n-max 2- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 上下文
- 1M
- 国内可达
- 需代理
当前运行配置
nvidia/Nemotron-Labs-TwoTower-30B-A3B-Base-BF16- 显存
- ~63GB BF16(估算)
查看详情查看运行方式(还有 1 种)
python3 -c "from transformers import AutoModelForCausalLM; AutoModelForCausalLM.from_pretrained('nvidia/Nemotron-Labs-TwoTower-30B-A3B-Base-BF16',trust_remote_code=True,torch_dtype='bfloat16').cuda()" (单GPU AR模式,约59GB显存)其它 1 种运行方式见详情页。
- 许可证
- NVIDIA Nemotron Open Model License
- 上下文
- 128k
- 国内可达
- 需代理
当前运行配置
nvidia/Qwen3.6-27B-NVFP4- 显存
- 暂无估算
查看详情查看运行方式
vllm serve nvidia/Qwen3.6-27B-NVFP4 --port 8000 --quantization modelopt --max-model-len 262144 --reasoning-parser qwen3- 为何暂无估算
- 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 262k
- 国内可达
- 需代理
当前运行配置
krea/Krea-2-Turbo- 显存
- 暂无估算
当前运行配置
BugTraceAI/BugTraceAI-CORE-Ultra-27B-Q6- 显存
- 暂无估算
当前运行配置
sahilchachra/Unlimited-OCR-GGUF- 显存
- 暂无估算
查看详情查看运行方式
huggingface-cli download sahilchachra/Unlimited-OCR-GGUF --include Unlimited-OCR-Q4_K_M.gguf mmproj-Unlimited-OCR-F16.gguf --local-dir ./uocr- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- MIT
- 国内可达
- 需代理
当前运行配置
AlperKTS/Krea2_FP8- 显存
- 暂无估算
查看详情查看运行方式
huggingface-cli download AlperKTS/Krea2_FP8 --local-dir ./krea2_fp8- 为何暂无估算
- 缺少可用的显存依据
- 许可证
- krea-2-license
- 国内可达
- 需代理
当前运行配置
HauhauCS/Gemma4-12B-QAT-Uncensored-HauhauCS-Balanced- 显存
- 暂无估算
查看详情查看运行方式
llama-server -m Gemma4-12B-QAT-Uncensored-HauhauCS-Balanced-Q4_K_M.gguf -md mtp-gemma-4-12B-it.gguf --spec-type draft-mtp --mmproj mmproj-Gemma4-12B-QAT-Uncensored-HauhauCS-Balanced-BF16.gguf -ngl 99 -fa on (需先下载gguf及mmproj文件)- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- gemma
- 上下文
- 256K
- 国内可达
- 需代理
当前运行配置
krea/Krea-2-Raw- 显存
- 暂无估算
查看详情查看运行方式(还有 1 种)
pip install git+https://github.com/sgl-project/sglang.git && sglang generate --model-path krea/Krea-2-Raw --prompt "a fox in the snow" --num-inference-steps 52 --height 1024 --width 1024 --guidance-scale 3.5 --save-output其它 1 种运行方式见详情页。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- krea-2-community-license
- 国内可达
- 需代理
当前运行配置
OpenMOSS-Team/MOSS-TTS-Local-Transformer-v1.5- 显存
- 暂无估算
当前运行配置
hotdogs/qwen3.6-27b-fable5-lora- 显存
- 暂无估算
查看详情查看运行方式
vllm serve Qwen/Qwen3.6-27B --enable-lora --lora-modules fable=hotdogs/qwen3.6-27b-fable5-lora- 为何暂无估算
- 权重格式未知,无法估算显存
- 国内可达
- 需代理
当前运行配置
Jackrong/Qwopus3.6-27B-Coder-Compat-MTP-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf Jackrong/Qwopus3.6-27B-Coder-Compat-MTP-GGUF (需代理下载)- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 上下文
- 32K
- 国内可达
- 需代理
当前运行配置
microsoft/FastContext-1.0-4B-RL- 显存
- 暂无估算
查看详情查看运行方式(还有 1 种)
python3 -m sglang.launch_server --model-path microsoft/FastContext-1.0-4B-RL --tool-call-parser qwen --context-length 262144 --trust-remote-code --dtype bfloat16 --host 0.0.0.0 --port 30000 --tp-size 1 --mem-fraction-static 0.8其它 1 种运行方式见详情页。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- MIT
- 上下文
- 262k
- 国内可达
- 需代理
当前运行配置
Mia-AiLab/Qwable-3.6-35b- 显存
- 暂无估算
查看详情查看运行方式
from transformers import AutoTokenizer, Qwen3_5ForConditionalGeneration; model = Qwen3_5ForConditionalGeneration.from_pretrained('Mia-AiLab/Qwable-3.6-35b', device_map='auto', torch_dtype='bfloat16')- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- MIT
- 国内可达
- 需代理
当前运行配置
ostris/ideogram_4_turbotime_lora- 显存
- 暂无估算
查看详情查看运行方式(还有 1 种)
from diffusers import DiffusionPipeline; pipe = DiffusionPipeline.from_pretrained('ideogram-ai/ideogram-4-fp8', dtype=torch.bfloat16, device_map='cuda'); pipe.load_lora_weights('ostris/ideogram_4_turbotime_lora')其它 1 种运行方式见详情页。
- 为何暂无估算
- 缺少可用的显存依据
- 许可证
- ideogram-4-non-commercial
- 上下文
- 不适用
- 国内可达
- 需代理
当前运行配置
deepseek-ai/DeepSeek-V4-Flash- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- mit
- 国内可达
- 魔搭可用
当前运行配置
deepseek-ai/DeepSeek-V4-Pro- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- mit
- 国内可达
- 魔搭可用
当前运行配置
owensong/Inflect-Nano-v1- 显存
- 暂无估算
当前运行配置
moonshotai/Kimi-K2.7-Code- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- other
- 国内可达
- 魔搭可用
当前运行配置
poolside/Laguna-M.1- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 国内可达
- 需代理
当前运行配置
MiniMaxAI/MiniMax-M3- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- other
- 国内可达
- 魔搭可用
当前运行配置
nex-agi/Nex-N2-Pro- 显存
- 暂无估算
查看详情暂无收录命令
本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 国内可达
- 魔搭可用
当前运行配置
Gryphe/Gemma-4-31B-StyleTune- 显存
- 暂无估算
查看详情查看运行方式
python -c "from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained('Gryphe/Gemma-4-31B-StyleTune')"- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 国内可达
- 需代理
当前运行配置
Jackrong/Qwopus3.6-27B-Coder-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf Jackrong/Qwopus3.6-27B-Coder-GGUF- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 32K
- 国内可达
- 需代理
- 其它形态
- GGUF·jackrong · GGUF·jackrong·MTP
当前运行配置
Mia-AiLab/Qwable-3.6-27b- 显存
- 暂无估算
查看详情查看运行方式
vllm serve Mia-AiLab/Qwable-3.6-27b- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- MIT
- 国内可达
- 需代理
当前运行配置
microsoft/FastContext-1.0-4B-SFT- 显存
- 暂无估算
查看详情查看运行方式(还有 1 种)
python3 -m sglang.launch_server --model-path microsoft/FastContext-1.0-4B-SFT --tool-call-parser qwen --context-length 262144 --trust-remote-code --dtype bfloat16 --host 0.0.0.0 --port 30000 --tp-size 1 --mem-fraction-static 0.8其它 1 种运行方式见详情页。
- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- MIT
- 上下文
- 262k
- 国内可达
- 需代理
当前运行配置
PaddlePaddle/PP-OCRv6_medium_det_safetensors- 显存
- 暂无估算
当前运行配置
nvidia/diffusiongemma-26B-A4B-it-NVFP4- 显存
- 暂无估算
查看详情查看运行方式
VLLM_USE_V2_MODEL_RUNNER=1 vllm serve nvidia/diffusiongemma-26B-A4B-IT-NVFP4 --trust-remote-code --max-num-seqs 4 --attention-backend TRITON_ATTN --enable-auto-tool-choice --tool-call-parser gemma4 --reasoning-parser gemma4 --override-generation-config '{"max_new_tokens": null}' --default-chat-template-kwargs '{"enable_thinking":true}' (需H100/B100)- 为何暂无估算
- 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
- 许可证
- Apache 2.0 (Gemma Terms)
- 上下文
- 256k
- 国内可达
- 需代理
当前运行配置
IndexTeam/IndexTTS-2- 显存
- 暂无估算
查看详情查看运行方式
暂无已验证的一键部署命令,需参考官方GitHub仓库(https://github.com/index-tts/index-tts)手动安装- 为何暂无估算
- 缺少可用的显存依据
- 国内可达
- 魔搭可用
当前运行配置
Zyphra/ZONOS2- 显存
- 暂无估算
查看详情查看运行方式
git clone https://github.com/Zyphra/ZONOS2 && cd ZONOS2 && uv sync && uv run python -m minisgl --model-path Zyphra/ZONOS2 --tts-default-voices-dir ./default_voices/(需 NVIDIA GPU, Linux)- 为何暂无估算
- 缺少可用的显存依据
- 许可证
- apache-2.0
- 语言
- 英语(主)·中文(主)·日语(主) · 韩/俄/意/葡/法/西/越/德/希伯来/荷兰/瑞典等 32 语种
- 国内可达
- 需代理
当前运行配置
SAi404/niko_constitution_gguf- 显存
- 暂无估算
查看详情查看运行方式
llama-cli -hf SAi404/niko_orchestrator_gguf --jinja- 为何暂无估算
- 权重格式未知,无法估算显存
- 国内可达
- 需代理
当前运行配置
unsloth/diffusiongemma-26B-A4B-it-GGUF- 显存
- 暂无估算
查看详情查看运行方式
DiffusionGemmaForBlockDiffusion.from_pretrained("google/diffusiongemma-26B-A4B-it", device_map="auto")- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache 2.0
- 上下文
- 256k
- 国内可达
- 需代理
当前运行配置
silx-ai/Quasar-Preview- 显存
- 暂无估算
查看详情查看运行方式
python -c "from transformers import AutoModelForCausalLM; AutoModelForCausalLM.from_pretrained('silx-ai/Quasar-Preview', trust_remote_code=True)"- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- MIT
- 上下文
- 5M (实验性配置)
- 国内可达
- 需代理
当前运行配置
marin-community/delphi-1e23-25Bparams-628Btokens- 显存
- 暂无估算
查看详情查看运行方式
transformers.from_pretrained('marin-community/delphi-1e23-25Bparams-628Btokens')- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 上下文
- 4k
- 国内可达
- 需代理
当前运行配置
unsloth/gemma-4-31B-it-qat-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf unsloth/gemma-4-31B-it-qat-GGUF:UD-Q4_K_XL --spec-type draft-mtp --spec-draft-n-max 4 -ngl 999- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 上下文
- 256k
- 国内可达
- 需代理
- 其它形态
- GGUF·unsloth · GGUF·google · GGUF·lmstudio
当前运行配置
pat-jj/harness-1- 显存
- 暂无估算
查看详情查看运行方式
transformers from_pretrained('pat-jj/harness-1')- 为何暂无估算
- 权重格式未知,无法估算显存
- 国内可达
- 需代理
当前运行配置
LiquidAI/LFM2.5-Audio-1.5B-JP- 显存
- 暂无估算
查看详情查看运行方式
pip install liquid-audio- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- LFM Open License v1.0
- 上下文
- 32k
- 国内可达
- 需代理
当前运行配置
lmstudio-community/gemma-4-12B-it-QAT-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf lmstudio-community/gemma-4-12B-it-QAT-GGUF- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 256K
- 国内可达
- 需代理
- 其它形态
- GGUF·lmstudio · GGUF·google · GGUF·unsloth
本档靠
google/gemma-4-12B-it-qat-q4_0-gguf(GGUF·google)- 显存
- ~7.2GB 4-bit(估算)
下方显存与命令都属于这个配置
本档靠
google/gemma-4-12B-it-qat-q4_0-gguf(GGUF·google)- 显存
- ~7.2GB 4-bit(估算)
下方显存与命令都属于这个配置
当前运行配置
lmstudio-community/gemma-4-E2B-it-QAT-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama.cpp: ./llama-cli -m <gguf-file>- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 国内可达
- 需代理
当前运行配置
lmstudio-community/gemma-4-E4B-it-QAT-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama.cpp -m gemma-4-E4B-it-QAT.gguf- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 国内可达
- 需代理
当前运行配置
ideogram-ai/ideogram-4-fp8- 显存
- 暂无估算
查看详情查看运行方式
diffusers: from_pretrained('ideogram-ai/ideogram-4-fp8')- 为何暂无估算
- 缺少可用的显存依据
- 许可证
- other
- 国内可达
- 需代理
当前运行配置
lmstudio-community/gemma-4-12B-it-GGUF- 显存
- 暂无估算
查看详情查看运行方式
ollama: ollama run hf.co/lmstudio-community/gemma-4-12B-it-GGUF:Q4_K_M- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache 2.0
- 上下文
- 256k
- 国内可达
- 需代理
- 其它形态
- GGUF·lmstudio · GGUF·unsloth
当前运行配置
LiquidAI/LFM2.5-8B-A1B- 显存
- 暂无估算
查看详情查看运行方式
transformers >= 5.0.0: AutoModelForCausalLM.from_pretrained('LiquidAI/LFM2.5-8B-A1B')- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- LFM1.0
- 上下文
- 128k
- 国内可达
- 需代理
- 其它形态
- 原生 · GGUF·liquidai · GGUF·unsloth
当前运行配置
nvidia/Qwen3.6-35B-A3B-NVFP4- 显存
- 暂无估算
查看详情查看运行方式
vllm serve nvidia/Qwen3.6-35B-A3B-NVFP4 --quantization modelopt- 为何暂无估算
- 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
- 许可证
- Apache 2.0
- 上下文
- 262k
- 国内可达
- 需代理
当前运行配置
prism-ml/bonsai-image-ternary-4B-mlx-2bit- 显存
- 暂无估算
查看详情查看运行方式
macOS: git clone https://github.com/PrismML-Eng/Bonsai-Image-Demo && cd Bonsai-Image-Demo && ./setup.sh && ./scripts/download_model.sh && ./scripts/generate.sh- 为何暂无估算
- 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
- 许可证
- apache-2.0
- 上下文
- 不适用
- 国内可达
- 需代理
当前运行配置
prism-ml/bonsai-image-binary-4B-mlx-1bit- 显存
- ~0.6GB 1-bit(估算)
查看详情查看运行方式
MLX Python: BONSAI_VARIANT=binary ./scripts/generate.sh --prompt "..."- 许可证
- apache-2.0
- 国内可达
- 需代理
当前运行配置
black-forest-labs/FLUX.1-dev- 显存
- 暂无估算
查看详情查看运行方式
diffusers: FluxPipeline.from_pretrained('black-forest-labs/FLUX.1-dev')- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- 非商业许可
- 上下文
- 不适用
- 国内可达
- 需代理
当前运行配置
tencent/Hy-MT2-1.8B-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf tencent/Hy-MT2-1.8B-GGUF- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 国内可达
- 魔搭可用
当前运行配置
lmstudio-community/granite-4.1-30b-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama.cpp: huggingface-cli download lmstudio-community/granite-4.1-30b-GGUF --include '*.gguf' --local-dir . && ./llama-cli -m <file>- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache 2.0
- 国内可达
- 需代理
当前运行配置
lmstudio-community/granite-4.1-3b-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama.cpp -m granite-4.1-3b-Q4_K_M.gguf- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 国内可达
- 需代理
当前运行配置
lmstudio-community/granite-4.1-8b-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama.cpp -m granite-4.1-8b.gguf- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 国内可达
- 需代理
当前运行配置
lmstudio-community/Nemotron-3-Nano-Omni-30B-A3B-Reasoning-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama-server -hf lmstudio-community/Nemotron-3-Nano-Omni-30B-A3B-Reasoning-GGUF- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- NVIDIA Open Model Agreement
- 国内可达
- 需代理
当前运行配置
nvidia/Nemotron-Labs-Diffusion-14B- 显存
- 暂无估算
查看详情查看运行方式
transformers from_pretrained()- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- NVIDIA Nemotron Open Model License
- 国内可达
- 需代理
当前运行配置
unsloth/Qwen3.6-27B-GGUF- 显存
- 暂无估算
查看详情查看运行方式
llama.cpp: ./main -m Qwen3.6-27B-Q4_K_M.gguf- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 上下文
- 262k (可扩展至1M)
- 国内可达
- 需代理
- 其它形态
- GGUF·unsloth · GGUF·lmstudio · GGUF·unsloth·MTP
当前运行配置
lmstudio-community/gemma-4-E4B-it-GGUF- 显存
- 暂无估算
查看详情查看运行方式
huggingface-cli download lmstudio-community/gemma-4-E4B-it-GGUF- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 国内可达
- 需代理
当前运行配置
prism-ml/Bonsai-8B-mlx-1bit- 显存
- ~1.2GB 1-bit(估算)
查看详情查看运行方式
pip install mlx-lm; pip install mlx@git+https://github.com/PrismML-Eng/mlx.git@prism; from mlx_lm import load; load('prism-ml/Bonsai-8B-mlx-1bit')- 许可证
- Apache-2.0
- 上下文
- 65k
- 国内可达
- 需代理
LTX-2.3模型的ComfyUI工作流集合,用于图像/视频生成。
当前运行配置
RuneXX/LTX-2.3-Workflows- 显存
- 暂无估算
查看详情查看运行方式
git clone https://huggingface.co/RuneXX/LTX-2.3-Workflows- 为何暂无估算
- 缺少可用的显存依据
- 国内可达
- 需代理
当前运行配置
mlx-community/whisper-large-v3-turbo- 显存
- 暂无估算
查看详情查看运行方式
pip install mlx-whisper && mlx_whisper audio.wav --model mlx-community/whisper-large-v3-turbo- 为何暂无估算
- 权重格式未知,无法估算显存
- 上下文
- 30s
- 国内可达
- 需代理
当前运行配置
Lakonik/AsymFLUX.2-klein-9B- 显存
- 暂无估算
查看详情查看运行方式
Python: pip install lakonlab 后用 PixelFlux2KleinPipeline 加载适配器- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- flux-non-commercial-license
- 国内可达
- 需代理
当前运行配置
HauhauCS/Gemma-4-E4B-Uncensored-HauhauCS-Aggressive- 显存
- 暂无估算
Gemma4 无审查多模态 MoE,面向创意写作与角色扮演
- 参数量
- 26B (25.2B total, 3.8B active)
- 商用
- 可商用
当前运行配置
HauhauCS/Gemma4-26B-A4B-Uncensored-HauhauCS-Balanced- 显存
- 暂无估算
查看详情查看运行方式
llama-server -m Gemma4-26B-A4B-Uncensored-HauhauCS-Balanced-Q4_K_P.gguf --mmproj mmproj-Gemma4-26B-A4B-Uncensored-HauhauCS-Balanced-f16.gguf --jinja -c 32768 -ngl 99- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- Apache-2.0
- 上下文
- 256K
- 国内可达
- 需代理
当前运行配置
Aratako/Irodori-TTS-500M-v3- 显存
- 暂无估算
查看详情查看运行方式
git clone https://github.com/Aratako/Irodori-TTS- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- MIT
- 国内可达
- 需代理
LTX2.3 微调的图生视频 GGUF 模型,用于 ComfyUI
当前运行配置
vantagewithai/LTX2.3-10Eros-GGUF- 显存
- 暂无估算
查看详情查看运行方式
git clone https://github.com/TenStrip/10S-Comfy-nodes custom_nodes/- 为何暂无估算
- 缺少可用的显存依据
- 国内可达
- 需代理
解禁版Qwen3.6-27B量化模型,为创意写作与代码而生
- 参数量
- 27B
- 商用
- 可商用
当前运行配置
DavidAU/Qwen3.6-27B-Heretic-Uncensored-FINETUNE-NEO-CODE-Di-IMatrix-MAX-GGUF- 显存
- ~57GB BF16(估算)
查看详情查看运行方式
llama-server -hf DavidAU/Qwen3.6-27B-Heretic-Uncensored-FINETUNE-NEO-CODE-Di-IMatrix-MAX-GGUF- 许可证
- apache-2.0
- 上下文
- 256k
- 国内可达
- 需代理
通用文本转语音,面向配音与有声内容制作者
当前运行配置
RunDiffusion/Juggernaut-Z-Image- 显存
- 暂无估算
查看详情查看运行方式
diffusers: from_pretrained('RunDiffusion/Juggernaut-Z-Image')- 为何暂无估算
- 缺少可用的显存依据
- 许可证
- cc-by-nc-4.0
- 国内可达
- 需代理
当前运行配置
jackxinning/Leanly_AI- 显存
- 暂无估算
查看详情查看运行方式
transformers: AutoModel.from_pretrained('jackxinning/Leanly_AI')- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 国内可达
- 需代理
当前运行配置
FrontiersMind/Nandi-Mini-600M-Early-Checkpoint- 显存
- 暂无估算
查看详情查看运行方式
transformers.from_pretrained('FrontiersMind/Nandi-Mini-600M-Early-Checkpoint')- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 上下文
- 2048
- 国内可达
- 需代理
当前运行配置
k2-fsa/OmniVoice- 显存
- 暂无估算
查看详情查看运行方式
pip install omnivoice- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- apache-2.0
- 上下文
- 不适用
- 国内可达
- 需代理
当前运行配置
Supertone/supertonic-3- 显存
- 暂无估算
查看详情查看运行方式
pip install supertonic- 为何暂无估算
- 权重格式未知,无法估算显存
- 许可证
- OpenRAIL-M
- 国内可达
- 需代理
TTS 模型,面向语音合成开发者
没有同时满足当前搜索与筛选条件的模型。
最近更新
按收录日期排列 · 共 381 个 · 第 111 期 2026-09-17 → · 全部归档 →