🐌r3gm / wan2-2-fp8da-aoti-preview-2c
输入图片和文本提示,生成对应视频。该空间基于 Wan2.2 模型,采用 FP8 精度和 AOTI 优化预览版。
收藏 2.0k · 2个月前更新 详情
输入图片和文本提示,生成对应视频。该空间基于 Wan2.2 模型,采用 FP8 精度和 AOTI 优化预览版。
Google DeepMind 开发的 Gemma 4 多模态开放权重模型,支持文本与图像输入(特定版本支持音频),输出文本。提供 Dense 和 MoE 架构,5 种尺寸(E2B 至 31B),上下文窗口达 256K 令牌,支持 140+ 语言。该空间展示 WebGPU 内核。
输入图片和文本提示,生成视频。基于 Wan2.2 14B 参数模型,480p 分辨率,使用 Lightning 和 Diffusers 库,支持 NSFW 内容。
在 Harvey's LAB 上进化智能体的 harness 而非模型本身。提供交互式科学论文模板,支持图表、数学公式、引用、暗模式及 PDF 导出。
输入关键词,跨模型 / 数据集 / 空间 / 工具 / 资讯 / 论文 检索