SummFlow 2026-06-11 Hugging Face

LFM2.5-Audio-1.5B-JP (LiquidAI)

日语端到端语音对话,1.5B轻量实时交互

入选理由
轻量端到端日语语音对话模型,支持实时语音交互、ASR、TTS,无需独立组件。适合需日语语音能力的开发者,但需自行安装 liquid-audio 库运行。
对位
Qwen2.5-Omni-3B / J-Moshi
适合
实时日语语音对话/客服 / 日语ASR转写与TTS合成
不适合
非日语语音识别与生成
规模
1.5B · 32k · Q4 ~1GB / FP16 ~3.5GB
授权
LFM Open License v1.0 · 需自查
框架
liquid-audio
血统
微调自 LFM2.5-Audio-1.5B
可信度
534下载,VoiceBench Elyza得分2.272,近似5.5B模型

仅 safetensors · 无 pickle 加载风险

社区实测

首个轻量级日语端到端语音模型,社区初步实测确认可本地离线运行、GGUF 可用

  • 端到端语音对话无需独立 ASR/TTS 组件
  • 1.5B 轻量参数可本地离线运行
  • 提供 GGUF 格式便于本地部署推理
  • 支持日语语音到语音交互

截至 2026-07-05

快速上手

pip install liquid-audio