30B 本地智能体多模态模型,GGUF 量化,文本+图像推理
适合本地自主代理执行 / 图像理解与工具调用
短板音频输入或无可靠网络环境
Q4 ~20GB / FP16 ~72GB · Apache-2.0 · 131k · llama.cpp需自查
证据135 赞
30B 本地智能体多模态模型,GGUF 量化,文本+图像推理
适合本地自主代理执行 / 图像理解与工具调用
短板音频输入或无可靠网络环境
Q4 ~20GB / FP16 ~72GB · Apache-2.0 · 131k · llama.cpp需自查
证据135 赞
6-bit MLX 量化推理模型,为 Apple Silicon 优化
适合Apple Silicon 设备端推理 / 需要思维链的复杂问答
短板简单对话(总启用思考)
Q4 ~1.7GB / FP16 ~6.2GB · LFM-1.0 · 未知 · mlx需自查
证据209 下载
图/文生成视频+音频,本地运行 GGUF 量化
适合本地图/文生成带音频视频 / 参考图/视频引导生成
短板实时或高分辨长视频
Q4 ~21GB / FP16 ~77GB · MiniMax H3 Community License (有地域限制) · 不适用 · stable-diffusion.cpp需自查
证据15 下载 / 83 赞
30B 多模态代理模型, 本地化量化推理
适合本地多模态代理执行 / 复杂工具调用与故障恢复
短板音频输入输出处理
Q4 ~20GB / FP16 ~72GB · Apache 2.0 · 128k+ · llama.cpp需自查
证据194 赞
输入关键词,跨模型 / 数据集 / 空间 / 工具 / 资讯 / 论文 检索