Diffusers
Hugging Face 的扩散模型库,几行代码跑图像/视频/音频生成
Hugging Face 的扩散模型库,支持图像、视频、音频生成。核心抽象是 `DiffusionPipeline`——把预训练模型、噪声 scheduler、processor 打包成一个可调用对象,从 Hub 加载模型、传入 prompt,几行 Python 即出结果。模块化设计:pipeline、scheduler、模型 backbone 均可互换,LoRA 等 adapter 无需改写 pipeline 即可插入。内置注意力切片、CPU offloading、量化等内存优化,大模型也能跑在消费级 GPU 上;覆盖 text-to-image、image-to-image、inpainting、text-to-video、text-to-audio、text-to-3D 等任务,被 InvokeAI、InstantID 等项目用作推理后端。
pip install --upgrade diffusers[torch] conda install -c conda-forge diffusers