此页是 2026-09-12 的观测快照,查看该模型当前信息 → /m/edge0__edge0-35b-a3b-preview/

归档 / 2026-09-12 / Edge0-35B-A3B-preview (Edge0)

Edge0-35B-A3B-preview (Edge0)

35B 稀疏 MoE,3 GiB 内存可跑,面向设备端推理

  • MLX
  • 已量化
入选理由
在 Apple Silicon 上以约 3GiB 内存运行 35B MoE,提供 OpenAI 兼容接口和现成 CLI,适合边缘部署。
对位
对位 Qwen3-30B-A3B 等开源 MoE
适合
Apple Silicon / 边缘设备本地推理 / 单机多 LoRA 适配器批量服务
不适合
长上下文与代理工具调用
规模
35B (3B 激活) · 未知 · Q4 ~23GB / FP16 ~83GB
授权
Apache-2.0 · 需自查
框架
edge0
血统
LoRA · 基于 Qwen3.5-MoE-35B-A3B
可信度
HF 951 下载 · 98 赞;模型卡含 OpenCompass 对比基准与速率数据

仅 safetensors · 无 pickle 加载风险

评分详情

Q1
今天能接上用吗   5 / 5
Q2
有可信证据吗   1 / 5
Q3
是新东西吗   1 / 5
总分
7

HuggingFace 原始数据 (抓取于 2026-09-12)

作者
Edge0
任务类型
text-generation
推理库
mlx
下载
951
点赞
98
许可证
Apache-2.0
标签
mlx, safetensors, qwen3_5_moe, moe, edge-inference, prerouter, lora, ssd-offload, text-generation, conversational, license:apache-2.0, 4-bit, region:us

探索

源链接