Cosmos3-Super-Text2Image (nvidia)
文本生成高保真图像,面向物理AI与创作
社区实测
开源权重文生图模型排名第一,长 prompt 遵循度和物理合理性表现突出,但 128GB+ 显存门槛使本地部署对绝大多数用户不现实。
- 长 prompt 下多语义元素完整率显著优于同类开源模型
- 物理合理性(折射、阴影方向、液体表面张力等)比通用模型扎实
- 在 Artificial Analysis 开源权重文生图与图生视频榜单均位列第一
- 部署需 8×H100 或等效显存,消费级显卡无法运行
- 模型仓库未附带正式技术报告,架构细节依赖社区逆向
- 文字渲染(尤其是中文长文本和手写体)仍落后于 GPT-image-2
- 官方技术资料未包含与 GPT-image-2 的对比
来源
英伟达Cosmos3-Super-Text2Image开源:生图新王登场,128G显存劝退本地党 - OpenAI HubNvidia releasesCosmos3-Super-Text2Image model . 64 billion paramteres : r/StableDiffusionArtificial Analysis on Xnvidia/Cosmos3-Super-Text2Image | vLLM Recipes
截至 2026-06-19
快速上手
vllm serve nvidia/Cosmos3-Super-Text2Image (vLLM-Omni)