🖼️selfit-camera / Omni-Image-Editor
基于自研 “Omni Creator” 多模态扩散模型的 Hugging Face 图像工具箱 Space,集成了图片编辑、文本生图、局部重绘、换脸、无损放大和水印去除等常用 AI 图像处理能力于一体,可直接在浏览器里交互使用。
基于自研 “Omni Creator” 多模态扩散模型的 Hugging Face 图像工具箱 Space,集成了图片编辑、文本生图、局部重绘、换脸、无损放大和水印去除等常用 AI 图像处理能力于一体,可直接在浏览器里交互使用。
Massive Text Embedding Benchmark 在 Hugging Face 上的交互式排行榜 Space,用统一界面展示各家文本/多模态向量模型在上百个检索、分类、聚类、重排、语义相似度等任务上的评分,是当前业界评估与对比 embedding 模型(尤其是用于 RAG)的标准公开榜单之一。
零样本表现力语音克隆与生成,支持情感、语速和呼吸控制,基于音频扩散 Transformer,需下载约 38GB 模型权重。
6B 参数的图像生成模型,采用 S3-DiT 架构,支持逼真生成、中英文文本渲染、提示推理增强和创意编辑。
在像素空间中生成逼真图像,基于Asymmetric Flow Models论文,来自斯坦福大学。
微软开源的 40 亿参数 Image‑to‑3D 生成模型,基于新提出的稀疏体素结构 O‑Voxel,把单张输入图片直接转成最高 1536³ 分辨率、带完整 PBR 材质的高保真 3D 资产,并提供 MIT 许可代码与 HF 权重用于研究和自建推理。
2B 参数的文生图模型,由 CircleStone Labs 与 Comfy Org 合作开发,专注动漫及非写实艺术风格,训练数据为真实动漫与艺术图像。
输入关键词,跨模型 / 数据集 / 空间 / 工具 / 资讯 / 论文 检索