🎵stabilityai / stable-audio-3
文本到音频生成demo,运行Stable Audio 3系列模型,提供Medium、Small Music、Small SFX三个变体,通过单选按钮切换。
文本到音频生成demo,运行Stable Audio 3系列模型,提供Medium、Small Music、Small SFX三个变体,通过单选按钮切换。
视频生成流水线 demo,以 iframe / API 形式封装,串联多模型从文本或图像产出短视频。
基于 Qwen-Image 的多视角生成 demo,从单张图生成不同机位与 3D 相机视角的图像。
运行模型 Qwen/Qwen-Image
基于Flux.2 Klein 9B LoRA的人脸交换应用,输入人脸图像和参考图像,输出换脸结果。
基于像素级统一 Transformer (UiT) 的图像生成基础模型,无需外部 VAE,原生处理像素、文本与条件,支持文生图、编辑和个性化,分辨率达 2048×2048。
基于Hugging Face生态的自主ML代理,能研究、编写并发布高质量ML代码,支持交互式会话和单次提词模式。
Hugging Face Nanotron 团队做的互动电子书/教程 Space,用实战视角系统讲清怎么在多机多卡 GPU 集群上训练大规模 LLM(数据并行、模型并行、流水线并行、ZeRO、内存/带宽瓶颈等),基于他们在 4,000+ 次、最高 512 GPU 的真实缩放实验经验总结,被称为“大规模 LLM 训练终极指南”。
基于Web的交互式科学文章模板,支持交互式图表、数学公式和可运行实验,替代静态PDF,延续Distill精神。
输入关键词,跨模型 / 数据集 / 空间 / 工具 / 资讯 / 论文 检索