🗣️victor / gemma-avatar
基于 Google DeepMind Gemma 4(31B MoE 模型)的实时语音对话 3D 头像 demo,输入语音经 STT、LLM、TTS 输出带唇同步和表情手势的 3D 头像回应,支持多模态和 140+ 语言。
2026-07-07
基于 Google DeepMind Gemma 4(31B MoE 模型)的实时语音对话 3D 头像 demo,输入语音经 STT、LLM、TTS 输出带唇同步和表情手势的 3D 头像回应,支持多模态和 140+ 语言。