🗣️victor / gemma-avatar
实时语音对话demo,使用Gemma 4 31B模型(Google DeepMind)进行推理,结合Silero-VAD、Parakeet STT、Qwen3-TTS,驱动3D头像实现嘴唇同步、表情和手势。
实时语音对话demo,使用Gemma 4 31B模型(Google DeepMind)进行推理,结合Silero-VAD、Parakeet STT、Qwen3-TTS,驱动3D头像实现嘴唇同步、表情和手势。
图像外绘demo,基于Krea 2 Turbo(8步蒸馏流匹配)和秩32 LoRA,上传图片并指定画布位置,模型填充扩展区域并保留原像素。
27B参数三元权重大模型(权重取-1/0/1,约1.71 bits/weight)的聊天demo,通过Hugging Face推理API运行,支持流式生成文本。
客户端可视化工具,展示Gemma 4的按宽高比保留图像缩放与token预算,输入图像和Nmax值,实时显示不同预算下的分辨率与token数。
训练LLM的指南文档,包含安装与本地运行说明,提供构建交互式网页的步骤。
交互式科学写作模板,用于构建LLM训练指南,支持图表、代码等web原生特性,基于Svelte/JavaScript。
输入关键词,跨模型 / 数据集 / 空间 / 工具 / 资讯 / 论文 检索