🎙️smolagents / hf-realtime-voice
基于WebSocket的语音对话demo,连接Hugging Face语音转语音后端,输入PCM16 16kHz麦克风音频,输出音频与转录。
收藏 398 · 12天前更新 详情
基于WebSocket的语音对话demo,连接Hugging Face语音转语音后端,输入PCM16 16kHz麦克风音频,输出音频与转录。
基于Wan2.2的图像转视频demo,支持单张图片或首尾帧引导生成视频,使用Lightning检查点,推荐4-8步推理。
运行模型 TestOrganizationPleaseIgnore/WAMU-Merge-MotionBoost_WAN2.2_I2V_LIGHTNING
LingBot-Video演示,首个开源大规模MoE视频生成模型(30B参数,约3B活跃),支持文生视频、图生视频、文生图,用于具身智能。
腾讯混元团队开发的Hy3多轮流式对话demo,295B参数MoE模型(21B活跃),支持函数调用,在推理、智能体、长上下文任务中表现优异。
运行模型 tencent/Hy3
输入关键词,跨模型 / 数据集 / 空间 / 工具 / 资讯 / 论文 检索