🌊ariG23498 / flow-matching
此 Space 是一个研究文章页面,使用 research-article-template 构建,页面名/主题为 flow-matching;仓库内含 app 目录、Dockerfile 与 nginx 配置,并提供本地开发与部署命令。
来自 HuggingFace · 可直接打开的 AI 在线演示 · 最近 14 天 · 共 29 个空间
此 Space 是一个研究文章页面,使用 research-article-template 构建,页面名/主题为 flow-matching;仓库内含 app 目录、Dockerfile 与 nginx 配置,并提供本地开发与部署命令。
此应用是 StepFun 的音乐生成前端 demo,可创建歌曲、生成伴奏、编排人声、音乐翻唱和混音;不运行本地模型,通过调用 step-music 模型/API 完成生成,需配置 API Key。
开源、本地优先的 AI 笔记工具:把文档、网页、录音、视频和 YouTube 链接转成带引用的结构化笔记,每条要点对应来源片段,支持中英双语与导出 Anki;MIT 许可。
运行模型 Lynote/humanize-text-model ↗
Marigold-V2 单目图像估计 demo:从单张图片预测深度图、表面法向量和反照率,属于计算机视觉中的几何/材质估计任务。
运行模型 Qwen/Qwen-Image-Edit-2509 ↗
技术文章,演示从想法到训练 4B 模型的完整过程:为 GeoGuessr 任务整理数据集、设计环境、用 OpenEnv 发布,并用 TRL 训练 Qwen3.5-4B 直至超过多个闭源模型;附源码与训练脚本。
完全在浏览器中运行的编码智能体 demo:通过 WebGPU 本地推理 MiniCPM5-2B(稠密 2B Transformer),包含 Pi 的 agent 核心与 just-bash,可对话、编辑文件并在持久工作区执行 shell 命令,无需 API 密钥或后端。
静态项目页面,展示 Marigold V2 模型:基于扩散 Transformer 从单张图像估计深度、表面法线和反照率,属于单目深度估计任务。
腾讯 AuK 的 Gradio 演示,1.5B 参数语音生成与编辑基础模型,通过统一自然语言指令支持零样本 TTS、内容与声学编辑、副语言编辑、语音增强和源分离,训练数据达数百万小时音频。
运行模型 tencent/AuK →
运行模型 m-a-p/YuE2-3B ↗
静态项目页面,展示 Marigold V2 模型:基于扩散 Transformer 从单张图像估计深度、表面法线和反照率,属于单目深度估计任务。
腾讯 AuK 的 Gradio 演示,1.5B 参数语音生成与编辑基础模型,通过统一自然语言指令支持零样本 TTS、内容与声学编辑、副语言编辑、语音增强和源分离,训练数据达数百万小时音频。
运行模型 tencent/AuK →
面向机器学习从业者的3D表示交互式指南,包含八个深度实验、四张支撑图表与八个原创台灯Manim动画序列。
交互式模型架构图工具,可搜索并可视化任意Hugging Face模型的内部结构,支持缩放、粒度调节与组件说明。
运行模型 Qwen/Qwen3.8-27B ↗
根据一段文本提示从一张图像生成视频的演示,输入为图像和文本,输出为视频,属于条件视频生成任务。
将静态图中的人物放入驱动视频的交互式演示:上传人物图和 4–10 秒驱动视频,先由 gpt-image-2 重绘首帧,再以该帧和视频为条件生成,4 步采样;基于 Viggle-Animate(源自 MiniMax-H3),无需姿态估计。
MiniCPM5-2B-Demo,一个以 MiniCPM5-2B 命名的模型演示空间;资料未给出更多功能细节。
基于果蝇连接组数据的浏览器内神经模拟 Demo:可绘制并刺激神经元,观察 Three.js 果蝇的行走、转向、飞行动画;使用 WebGPU 计算,无需外部模型服务。
该 demo 基于 LTX 2.3 改进版,主要功能是从图像生成视频,输出的视频支持原生音频,属于视频生成类任务。
Krea 2 Turbo 的文本生成图像与图像编辑 demo,基于无头 ComfyUI 执行;支持自定义 Hugging Face 基座模型、LoRA 和身份编辑模式。
运行模型 Comfy-Org/Krea-2 ↗
该图像编辑 demo 支持输入一张或两张图像,基于这些图像完成编辑;资料未说明具体编辑功能或底层模型。
运行模型 oauth/authorize ↗
运行模型 black-forest-labs/FLUX.2-dev ↗
输入关键词,跨模型 / 数据集 / 空间 / 工具 / 资讯 / 论文 检索