指南 / 视频生成模型

视频生成模型

共 18 个 · 数据更新于 2026-09-14

  • LTX-2.5 FP8视频模型,合并多个LoRA,支持文/图生视频

    商用
    需自查

    当前运行配置 ChrisColeTech/LTX-2.5-uncensored-v1.1-FP8

    显存
    暂无估算
    查看详情
    暂无收录命令

    本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

    为何暂无估算
    缺少可用的显存依据
    国内可达
    需代理
  • VDN-Minimax-H3 (OpenVDN)

    微调自 MiniMax-H3

    混合注意力视频生成:14.4s片段11.23s

    商用
    需自查

    当前运行配置 OpenVDN/vdn-minimax-h3

    显存
    暂无估算
    查看详情
    暂无收录命令

    本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

    为何暂无估算
    缺少可用的显存依据
    许可证
    MiniMax H3 Community License Agreement(排除 EU/UK/KR/US)
    国内可达
    需代理
  • 文本生成同步音视频,4步推理

    参数量
    35B
    商用
    需自查

    当前运行配置 FastVideo/FastVideo-FastH3-4-step-Preview-v1-VSA-DataFree

    显存
    暂无估算
    查看详情
    暂无收录命令

    本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

    为何暂无估算
    权重格式未知,无法估算显存
    许可证
    MiniMax H3 Community License
    国内可达
    需代理
  • H3×Z-Image 嫁接,ComfyUI 文生视频

    商用
    需自查

    当前运行配置 joeygambino/MiniMax-H3-x-Z-Image-native

    显存
    暂无估算
    查看详情
    暂无收录命令

    本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

    为何暂无估算
    缺少可用的显存依据
    许可证
    minimax-h3-community-license
    国内可达
    需代理
  • MiniMax-H3-Acc-LoRAs (阿里 PAI)

    微调自 MiniMax-H3-Acc-LoRAs

    MiniMax-H3 8步加速 LoRA,面向视频生成

    商用
    可商用

    当前运行配置 alibaba-pai/MiniMax-H3-Acc-LoRAs

    显存
    暂无估算
    查看详情
    暂无收录命令

    本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

    为何暂无估算
    缺少可用的显存依据
    许可证
    apache-2.0
    上下文
    不适用
    国内可达
    需代理
  • MiniMax-H3 流式视频生成 LoRA

    商用
    需自查

    当前运行配置 mvp-lab/MiniMax-H3-RAVEN-Streaming-LoRA

    显存
    暂无估算
    查看详情
    暂无收录命令

    本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

    为何暂无估算
    缺少可用的显存依据
    许可证
    MiniMax-H3 Community License Agreement
    国内可达
    需代理
  • MiniMax-H3 视频控制分支,支持 5 种控制条件与视频修复

    商用
    需自查

    当前运行配置 alibaba-pai/MiniMax-H3-Fun-Controlnet-Union

    显存
    暂无估算
    查看详情
    暂无收录命令

    本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

    为何暂无估算
    缺少可用的显存依据
    许可证
    MiniMax-H3 Community License Agreement
    国内可达
    需代理
  • MiniMax-H3 (DeepBeepMeep)

    量化自 MiniMax-H3

    MiniMax H3 图像模型集,WanGP 可用

    参数量
    32B
    商用
    需自查

    当前运行配置 DeepBeepMeep/MiniMax-H3

    显存
    暂无估算
    查看详情
    暂无收录命令

    本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

    为何暂无估算
    权重格式未知,无法估算显存
    许可证
    MiniMax H3 Community License (有地域限制)
    上下文
    不适用
    国内可达
    需代理
    其它形态
    原生 · GGUF·abiray · GGUF·unsloth
  • ComfyUI 用 Qwen3-VL 4B/8B 替代 H3 编码器

    参数量
    4B
    商用
    需自查

    当前运行配置 NicoLab28/ClipProj-MiniMax-H3

    显存
    暂无估算
    查看详情
    暂无收录命令

    本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

    为何暂无估算
    权重格式未知,无法估算显存
    许可证
    MIT(投影矩阵);基座模型 Apache 2.0 / MiniMax 自定义许可
    国内可达
    需代理
  • MiniMax H3 Realism People LoRA (fal)

    LoRA · 基于 MiniMax-H3

    MiniMax-H3 真人写实 LoRA,专攻人像与日常场景视频生成

    商用
    需自查

    当前运行配置 fal/MiniMax-H3-Realism-People-LoRA

    显存
    暂无估算
    查看详情
    暂无收录命令

    本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

    为何暂无估算
    缺少可用的显存依据
    许可证
    minimax-h3-community-license
    国内可达
    需代理
  • MiniMax-H3 Turbo LoRA (drbaph)

    LoRA · 基于 MiniMax-H3

    MiniMax-H3 4步加速LoRA,ComfyUI 专用

    商用
    可商用

    当前运行配置 drbaph/MiniMax-H3-Turbo-Lora-ComfyUI

    显存
    暂无估算
    查看详情
    暂无收录命令

    本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

    为何暂无估算
    缺少可用的显存依据
    许可证
    apache-2.0
    国内可达
    需代理
  • MiniMax-H3 Turbo LoRA (larryvrh)

    LoRA · 基于 MiniMax-H3

    4步生成同步音视频的 MiniMax-H3 加速 LoRA

    商用
    可商用

    当前运行配置 larryvrh/MiniMax-H3-Turbo-Lora

    显存
    暂无估算
    查看详情
    暂无收录命令

    本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

    为何暂无估算
    缺少可用的显存依据
    许可证
    apache-2.0
    国内可达
    需代理
  • LTX-Best-Face-ID (Alissonerdx)

    LoRA · 基于 LTX-2.3

    LTX-2.3 身份保持 LoRA,单参考图加提示生成人物视频

    参数量
    22B (基模型)
    商用
    需自查

    当前运行配置 Alissonerdx/LTX-Best-Face-ID

    显存
    暂无估算
    查看详情
    暂无收录命令

    本站暂未收录这个配置的命令;请看详情页或官方仓库,不借用其它配置的命令。

    为何暂无估算
    权重格式未知,无法估算显存
    许可证
    other
    国内可达
    需代理
  • 分钟级多镜头音视频长视频生成,面向研究者

    商用
    需自查

    当前运行配置 jdopensource/JoyAI-Echo

    显存
    暂无估算
    查看详情
    查看运行方式(还有 2 种)
    huggingface-cli download google/gemma-3-12b-it --local-dir checkpoints/gemma-3-12b/ && python inference.py

    其它 2 种运行方式见详情页

    为何暂无估算
    缺少可用的显存依据
    许可证
    LTX-2 Community License (研究/非商用)
    国内可达
    需代理
  • NAVA-6.3B (Baidu)

    微调自 Wan2.2-TI2V-5B

    文本/图像生成音视频同步内容,支持多说话人音色控制

    参数量
    6.3B
    商用
    可商用

    当前运行配置 baidu/NAVA

    显存
    暂无估算
    查看详情
    查看运行方式(还有 1 种)
    git clone https://github.com/ernie-research/NAVA && cd NAVA && huggingface-cli download baidu/NAVA --local-dir .

    其它 1 种运行方式见详情页

    为何暂无估算
    权重格式未知,无法估算显存
    许可证
    Apache-2.0
    上下文
    文本 512 tokens · 最大 10 秒视频
    国内可达
    需代理
  • LTX-2.3模型的ComfyUI工作流集合,用于图像/视频生成。

    当前运行配置 RuneXX/LTX-2.3-Workflows

    显存
    暂无估算
    查看详情
    查看运行方式
    git clone https://huggingface.co/RuneXX/LTX-2.3-Workflows
    为何暂无估算
    缺少可用的显存依据
    国内可达
    需代理
  • LTX2.3-10Eros-GGUF (vantagewithai)

    量化自 LTX2.3-10Eros

    LTX2.3 微调的图生视频 GGUF 模型,用于 ComfyUI

    当前运行配置 vantagewithai/LTX2.3-10Eros-GGUF

    显存
    暂无估算
    查看详情
    查看运行方式
    git clone https://github.com/TenStrip/10S-Comfy-nodes custom_nodes/
    为何暂无估算
    缺少可用的显存依据
    国内可达
    需代理
  • 图像到视频基座模型,GGUF量化版,适合本地推理

    参数量
    22B

    当前运行配置 SulphurAI/Sulphur-2-base

    显存
    暂无估算
    查看详情
    查看运行方式(还有 1 种)
    diffusers.from_pretrained('SulphurAI/Sulphur-2-base')

    其它 1 种运行方式见详情页

    为何暂无估算
    权重格式未知,无法估算显存
    许可证
    other
    国内可达
    需代理
    其它形态
    原生 · GGUF

常见坑

  • 模型仅在近照人脸裁剪上训练,未见过人物实际衣着或身体,衣着和身体部分依赖模型猜测 —— Alissonerdx/LTX-Best-Face-ID
  • 模型体积大(46GB),单卡 B200 峰值显存约 39GB,消费级硬件难以运行 —— jdopensource/JoyAI-Echo
  • vllm-omni 集成尚不完全(Attention 未接入、小画布 warmup 未启用),生产可用性待验证 —— jdopensource/JoyAI-Echo
  • 仅限学术研究与非商业用途 —— jdopensource/JoyAI-Echo
  • 部分用户认为一体式工作流过于复杂,更偏好简洁的首帧/末帧工作流 —— RuneXX/LTX-2.3-Workflows
  • 官方工作流明显优于 ComfyUI 内置版本,内置版体验较差 —— RuneXX/LTX-2.3-Workflows
  • 单通道模式虽可降低显存占用,但输出分辨率较低 —— RuneXX/LTX-2.3-Workflows
  • 基于 LTX2.3-DEV 微调,原版糟糕的字幕/描述问题重现 —— vantagewithai/LTX2.3-10Eros-GGUF
展开其余 9 条
  • LTX-2.3 的常见问题仍未解决 —— vantagewithai/LTX2.3-10Eros-GGUF
  • GGUF 量化存在兼容性问题,模型合并会改变 tensor 维度导致 loader 报错 —— vantagewithai/LTX2.3-10Eros-GGUF
  • FP8 版本仍需约 29 GB,显存占用偏大 —— vantagewithai/LTX2.3-10Eros-GGUF
  • GGUF 量化建议不低于 Q4,否则画质明显下降 —— vantagewithai/LTX2.3-10Eros-GGUF
  • FP8 体积约 29GB,对硬件门槛要求高 —— SulphurAI/Sulphur-2-base
  • 继承 LTX-2.3 的常见问题,画面连贯性和鲁棒性不如 Wan 2.2 —— SulphurAI/Sulphur-2-base
  • 官方工作流体验不佳 —— SulphurAI/Sulphur-2-base
  • 存在兼容性报错,如 Gemma3TextConfig 缺少 rope_local_base_freq 属性 —— SulphurAI/Sulphur-2-base
  • 社区中不少人推荐 10Eros 微调版而非原版 —— SulphurAI/Sulphur-2-base

收藏本页,或 订阅 RSS 追踪每日更新。