🎬bytedance-research / Lance
Lance是一个3B参数的原生统一多模态模型,支持图像与视频的理解、生成和编辑,由字节跳动研究团队开发。
运行模型 bytedance-research/Lance ↗
本页记录当日收录项目;运行状态与体验入口按当前结果更新。完整目录见 Space 体验目录。
Lance是一个3B参数的原生统一多模态模型,支持图像与视频的理解、生成和编辑,由字节跳动研究团队开发。
运行模型 bytedance-research/Lance ↗
InstantID 是一个免调参的保持身份一致性的图像生成 demo,输入单张人脸图像即可生成保持该身份的图像,支持多种下游任务;底层使用 SDXL、ControlNet 和 IP-Adapter,并搭配人脸编码器。
运行模型 InstantX/InstantID ↗
LivePortrait 的官方 PyTorch 实现:将驱动视频中的人脸运动迁移到静态人像上,实现人像动画,具备拼接与重定向控制;仓库提供预训练权重和使用说明。
DALL·E Mini 的演示:根据文本提示生成图像,面向研究与个人使用;其中 DALL·E Mega 是最大版本,可用于创意等下游场景。
基于 RealVisXL_Turbo 的高分辨率写实(IRL)图像生成 demo,标签为 MidJour。
OpenAI 开源的 encoder–decoder Transformer 通用语音识别与翻译模型,68 万小时多语言多任务弱监督训练,在嘈杂、多口音与跨语言转写上鲁棒性强。
运行模型 openai/whisper-large-v3 →
AnyCoder 是一个全栈 AI 代码生成应用,用户用自然语言描述需求即可生成应用,支持多种 AI 模型与多个语言,并可一键部署到 Hugging Face Spaces;前端 React/TypeScript,后端 FastAPI,许可证 Modified-MIT。
图像反推提示词工具,结合 CLIP 与 BLIP 分析图片,输出可复现该图风格的文本 prompt,常用于扩散模型的提示词逆向。
输入关键词,跨模型 / 数据集 / 空间 / 工具 / 资讯 / 论文 检索