模型 / 归档 / 2026-08-15

本期 (2)

27B

Qwen3.8-27B GGUF,本地推理与多模态

适合长上下文智能体与工具调用 / 图像/视频等多模态理解

短板8GB 级显存设备

Q4 ~18GB / FP16 ~65GB · Apache-2.0 · 262k (可扩展至 1M) · llama.cpp需自查

证据727 赞

2.6B

2.6B 5-bit MLX 量化,Mac 本地推理

  • MLX

适合Mac 本地文本生成 / 边缘设备低显存推理

短板非 Apple Silicon 平台

Q4 ~1.7GB / FP16 ~6.2GB · LFM Open License v1.0 · 未知 · mlx需自查

证据315 下载

← 前一日 2026-08-14 · 后一日 2026-08-16 →