🌳webml-community / bonsai-webgpu-kernels
在浏览器中通过WebGPU运行1-bit 27B大语言模型,使用二进制transformer权重(每权重1.125比特),实现在地推理。
运行模型 prism-ml/Bonsai-27B-gguf →
收藏 392 · 1个月前更新
本页记录当日收录项目;运行状态与体验入口按当前结果更新。完整目录见 Space 体验目录。
在浏览器中通过WebGPU运行1-bit 27B大语言模型,使用二进制transformer权重(每权重1.125比特),实现在地推理。
运行模型 prism-ml/Bonsai-27B-gguf →
从单张起始图像实时生成可交互导航的虚拟世界,支持WASD/IJKL键盘控制视角移动,基于ABot-World-0-5B扩散模型。
运行模型 acvlab/ABot-World-0-5B-LF ↗
Mage-VL 4B编解码器原生视觉语言模型,用于视频与图像理解,通过仅保留关键帧和运动区域补丁减少75%以上视觉token。
运行模型 microsoft/Mage-VL ↗
从单张图像重建3D高斯场景表示,支持RGB-only及RGB-深度引导两种模式,提供交互式查看器与PLY下载。
基于BS-Roformer(频段分割Transformer)的音频源分离工具,上传音频文件即可提取人声或乐器音轨,支持四种模型变体。
运行模型 pcunwa/BS-Roformer-Leap ↗
OpenAI 开源的 encoder–decoder Transformer 通用语音识别与翻译模型,68 万小时多语言多任务弱监督训练,在嘈杂、多口音与跨语言转写上鲁棒性强。
运行模型 openai/whisper-large-v3 →
输入关键词,跨模型 / 数据集 / 空间 / 工具 / 资讯 / 论文 检索