Qwen3.8-27B GGUF,本地推理与多模态
适合长上下文智能体与工具调用 / 图像/视频等多模态理解
短板8GB 级显存设备
Q4 ~18GB / FP16 ~65GB · Apache-2.0 · 262k (可扩展至 1M) · llama.cpp需自查
证据727 赞
Qwen3.8-27B GGUF,本地推理与多模态
适合长上下文智能体与工具调用 / 图像/视频等多模态理解
短板8GB 级显存设备
Q4 ~18GB / FP16 ~65GB · Apache-2.0 · 262k (可扩展至 1M) · llama.cpp需自查
证据727 赞
2.6B 5-bit MLX 量化,Mac 本地推理
适合Mac 本地文本生成 / 边缘设备低显存推理
短板非 Apple Silicon 平台
Q4 ~1.7GB / FP16 ~6.2GB · LFM Open License v1.0 · 未知 · mlx需自查
证据315 下载
输入关键词,跨模型 / 数据集 / 空间 / 工具 / 资讯 / 论文 检索