可用 CPU 运行的语音合成模型
共 7 个
Gepard-1.0 (nineninesix) 流式自回归 TTS,面向实时对话与语音代理 Kokoro-82M (hexgrad) 82M 参数轻量 TTS 模型,支持多语言,可本地部署 Inflect-Nano-v1 (owensong) 超小型英文TTS,总4.63M参数,适合本地/嵌入式实验 Qwen3-TTS-12Hz-1.7B-CustomVoice (Qwen) 指令式多语言TTS,流式延迟低至97ms,9音色 Irodori-TTS-500M-v3 (Aratako) 日语TTS,表情符号控制风格,零样本克隆 OmniVoice (k2-fsa) 为开发者提供600+语言零样本语音合成 Supertonic 3 (Supertone) 31种语言本地TTS,面向AI应用开发者的语音合成