模型 / Inflect-Nano-v2 (Owensong)

Inflect-Nano-v2 (Owensong)

4M参数本地英文TTS,CPU实时推理

作者 owensong

仓库标识owensong/Inflect-Nano-v2

~0.1GB 4-bit许可 可商用任务 语音合成最近核对 2026-08-05
格式
4-bit
文件
~0.1GB
运行内存
~0.1GB
运行时
pytorch
下载
252

Hugging Face 源仓库 ↗

适合与不适合

入选理由
今天就能在HF Space试用的4M参数英语TTS,本地CPU可跑,有ONNX导出,适合边缘部署和离线语音合成。
对位
同级 KittenTTS Nano
适合
边缘设备本地语音合成 / 离线英文TTS服务
不适合
多语种及零样本语音克隆

独立证据与社区反馈

1 个独立来源 · 另 1 官方/转载最近验证 2026-08-05

独立来源不足,尚未形成社区共识:社区认可其极小的参数量(Nano-v2 不到 4M)和较快的推理速度(10.72× 实时),Reddit 上有用户反馈声音自然。

  • 在消费级硬件上运行完整端到端文本转语音
  • 极低参数量的 TTS 模型(Nano-v2 约 4M 参数)
  • 快速的推理速度(Nano-v2 RTF 0.0933,10.72 倍实时)
  • 目前仅支持英文(英文音素前端)
  • 当前模型音色单一,多语言和多音色尚在规划中
  • 独立开发者项目,后续更新依赖社区反馈和兴趣

可信度3.97M参数,盲测偏好63.9%,CPU 10.72x实时

完整规格

规模
3.97M · 不适用 · 下载 ~0.1GB · 显存最低 ~0.1GB · 4-bit(估算)
授权
apache-2.0 · 可商用
框架
pytorch / onnx
语种
英文
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 735 → 323 · likes +4

观测时间线