SummFlow 2026-06-11 Hugging Face

🌳webml-community / bonsai-image-webgpu

基于三元权重(1.58-bit)的文本到图像扩散Transformer,在浏览器中运行,支持Apple Silicon,模型大小为1.21GB(相对FP16压缩6.4倍)。

运行模型 prism-ml/bonsai-image-ternary-4B-mlx-2bit

收藏 279 · 1个月前更新
  • static
  • 运行中
详情 查看源

gemma-challenge / gemma-dashboard

Gemma效率挑战赛的监控面板,展示队伍在固定GPU上对google/gemma-4-E4B-it模型的推理速度(TPS)和质量(PPL)排名。

运行模型 google/gemma-4-E4B-it

收藏 33 · 1个月前更新
  • docker
  • 运行中
详情 查看源

🎙️openbmb / VoxCPM-Demo

VoxCPM2语音模型的Gradio演示,使用Nano-vLLM后端进行推理。

收藏 584 · 1个月前更新
  • gradio
  • 运行中
详情