模型 / 归档 / 2026-08-11

本期 (4)

30B

30B 本地智能体多模态模型,GGUF 量化,文本+图像推理

适合本地自主代理执行 / 图像理解与工具调用

短板音频输入或无可靠网络环境

Q4 ~20GB / FP16 ~72GB · Apache-2.0 · 131k · llama.cpp需自查

证据135 赞

2.6B

6-bit MLX 量化推理模型,为 Apple Silicon 优化

  • MLX

适合Apple Silicon 设备端推理 / 需要思维链的复杂问答

短板简单对话(总启用思考)

Q4 ~1.7GB / FP16 ~6.2GB · LFM-1.0 · 未知 · mlx需自查

证据209 下载

32B

图/文生成视频+音频,本地运行 GGUF 量化

适合本地图/文生成带音频视频 / 参考图/视频引导生成

短板实时或高分辨长视频

Q4 ~21GB / FP16 ~77GB · MiniMax H3 Community License (有地域限制) · 不适用 · stable-diffusion.cpp需自查

证据15 下载 / 83 赞

30B

30B 多模态代理模型, 本地化量化推理

适合本地多模态代理执行 / 复杂工具调用与故障恢复

短板音频输入输出处理

Q4 ~20GB / FP16 ~72GB · Apache 2.0 · 128k+ · llama.cpp需自查

证据194 赞

← 前一日 2026-08-10 · 后一日 2026-08-12 →