230M混合架构,为边缘设备推理与代理任务设计
适合设备端数据抽取 / 轻量代理流程
短板复杂推理、数学、代码生成
Q4 ~0.2GB / FP16 ~0.6GB · LFM1.0 · 32768 · transformers需自查
证据7334 下载 / 65 赞 / 3 个社区来源
230M混合架构,为边缘设备推理与代理任务设计
适合设备端数据抽取 / 轻量代理流程
短板复杂推理、数学、代码生成
Q4 ~0.2GB / FP16 ~0.6GB · LFM1.0 · 32768 · transformers需自查
证据7334 下载 / 65 赞 / 3 个社区来源
轻量级代理编码开源模型,单 GPU 可部署
适合Coding Agent 任务 / 单 GPU 本地推理
短板非编码类通用对话
35B · MIT · 256k · llama.cpp需自查
证据65 赞 / 3 个社区来源
27B 无审查多模态混合模型,本地创作者使用
适合无审查对话与角色扮演 / 多模态图像与文档理解
短板需要内容过滤的生产环境
27B · apache-2.0 · 未知 · llama.cpp需自查
证据31.3k 下载 / 8 赞 / 13 个社区来源
IQ2_M 31B 多模态 Agent,10 GiB 本地运行
适合本地多模态 Agent 推理 / 代码与工具调用任务
短板高精度语言生成
31B · gemma · 未知 · llama.cpp需自查
证据12.5k 下载 / 12 个社区来源
3B无审查推理模型,专注数学与竞赛编程
适合数学与竞赛编程推理 / 可验证分数信号的任务(如LeetCode题)
短板工具调用 / agent 编程
Q4 ~2GB / FP16 ~7.4GB · MIT · 未知 · transformers需自查
证据6893 下载 / 56 赞 / 1 个社区来源
无审查的27B视觉语言模型,用于多模态对话与图像理解
适合多模态无审查对话 / 图像描述与视觉问答
短板需要安全过滤的生产环境
27B · apache-2.0 · 未知 · llama.cpp需自查
证据7462 下载 / 10 赞 / 8 个社区来源
输入关键词,跨模型 / 数据集 / 空间 / 工具 / 资讯 / 论文 检索