文本/图像生成音视频同步内容,支持多说话人音色控制
适合文本/图像生成带同步音频的视频 / 多说话人场景指定音色控制
短板单 GPU 实时推理或长于 10 秒视频
6.3B · Apache-2.0 · 未知 · torch可商用
证据159 下载 / 57 赞 / 2 个社区来源
文本/图像生成音视频同步内容,支持多说话人音色控制
适合文本/图像生成带同步音频的视频 / 多说话人场景指定音色控制
短板单 GPU 实时推理或长于 10 秒视频
6.3B · Apache-2.0 · 未知 · torch可商用
证据159 下载 / 57 赞 / 2 个社区来源
循环异构图语言模型,用于个性化微调与端侧推理
适合个性化语言模型冷启动训练 / 端侧或离线文本生成
短板事实性要求高的问答场景
Q4 ~0GB / FP16 ~0.1GB · Modified Apache 2.0 · 1024 · transformers需自查
证据134 下载 / 1 赞
Google Gemma 4 12B 指令模型,GGUF 量化版本
适合本地离线聊天与问答 / 指令遵循与工具调用
短板多模态或极长上下文
12B · Apache 2.0 · 未知 · llama.cpp可商用
证据124 下载 / 3 个社区来源
12B 多模态模型,支持图文音频输入,本地 GGUF 量化部署
适合本地多模态聊天 / OCR 与文档理解
短板资源受限移动设备
12B · Apache 2.0 · 256k · llama.cpp可商用
证据78 赞 / 6 个社区来源
输入关键词,跨模型 / 数据集 / 空间 / 工具 / 资讯 / 论文 检索