🌳webml-community / bonsai-image-webgpu
基于三元权重(1.58-bit)的文本到图像扩散Transformer,在浏览器中运行,支持Apple Silicon,模型大小为1.21GB(相对FP16压缩6.4倍)。
2026-06-11
基于三元权重(1.58-bit)的文本到图像扩散Transformer,在浏览器中运行,支持Apple Silicon,模型大小为1.21GB(相对FP16压缩6.4倍)。
Gemma效率挑战赛的监控面板,展示队伍在固定GPU上对google/gemma-4-E4B-it模型的推理速度(TPS)和质量(PPL)排名。
VoxCPM2语音模型的Gradio演示,使用Nano-vLLM后端进行推理。