模型 / AuK-1.5B (Tencent)

AuK-1.5B (Tencent)

开源语音生成与编辑基础模型,支持零样本 TTS

作者 tencent

仓库标识tencent/AuK

显存未知许可 可商用任务 语音合成最近核对 2026-09-12
运行内存
权重格式未知,无法估算显存
运行时
PYTHON
下载
554

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

快速上手示例

python -m sglang_omni.cli serve --model-path tencent/AuK

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
开源语音生成与编辑基础模型,支持零样本TTS、指令编辑、增强分离,有在线Demo可即时试用,适合语音创作者。
对位
对位 CosyVoice2、F5-TTS
适合
零样本语音克隆与音色复刻 / 语音内容/情感编辑与降噪增强
不适合
音乐生成 / 作曲

完整规格

规模
1.5B · 权重格式未知,无法估算显存
授权
MIT · 可商用
框架
sglang-omni
语种
未公开
访问提示
标记为魔搭可用,具体仓库请自行核对

在线体验

观测时间线