指南 / 文本生成模型 / 可商用

可商用的文本生成模型

共 26 个

Gemma-4-31B-StyleTune (Gryphe) Gemma 4 31B风格微调,陈词减60%,角色扮演与创意写作。 VibeThinker-3B (WeiboAI) 面向数学/代码/STEM的可验证推理3B小模型 FastContext-1.0-4B-SFT (Microsoft) 轻量仓库探索子代理,供编码代理按需调用,减少 token 消耗 DiffusionGemma-26B-A4B-it-NVFP4 (NVIDIA) 扩散多模态文本生成,3.8B活跃参数,NVFP4量化 Z-Image-Engineer-V6 (BennyDaBall) 4B 提示词增强与 Z-Image 文本编码器,本地双用途 Gemma4-12B-Coder (yuxinlu1) 本地 Python 编程模型,离线解决算法问题 Quasar-Preview (silx-ai) 18B MoE预览模型,面向Bittensor SN24研究蒸馏 Delphi-25B (Marin Community) Delphi扩展律研究基座,25B参数,终版模型 Nex-N2-mini (nex-agi) 面向编码与工具调用的智能体模型 Qwen3.5-0.8B-OptiQ-4bit (mlx-community) 苹果芯片4-bit MLX 量化 Qwen3.5-0.8B Qwen3.5-2B-OptiQ-4bit (mlx-community) 4-bit混合精度MLX量化Qwen3.5-2B,苹果芯片推理 Qwen3.6-27B-MTPLX (Youssofal) Qwen3.6-27B 的 MLX 推理加速版供苹果芯片 Qwen3.6-27B-OptiQ-4bit (mlx-community) Apple Silicon的Qwen3.6-27B 4bit混合量化版 Qwen3.6-35B-A3B-OptiQ-4bit (mlx-community) Apple Silicon 4-bit MLX混精量化+MTP投机解码 Mellum2-12B-A2.5B-Instruct (JetBrains) 直接回答的指令模型,用于交互聊天、代码和工具调用 Mellum2-12B-A2.5B-Thinking (JetBrains) 思考型助手,在<think>块中输出推理链后给出最终答案 Qwen3.5-9B (Qwen) Qwen3.5-9B MoQ量化版,MTP推测解码,适合本地快速生成 Qwen3.6-35B-A3B-NVFP4 (NVIDIA) Qwen3.6-35B-A3B FP4量化版,面向vLLM高效推理 BitCPM-CANN-8B (OpenBMB) 昇腾原生1.58-bit三元LLM,推理内存降6x,保持95.7%性能 aro-coder-4bit (ARO-Lang) 为ARO语言微调的代码生成器,4bit量化,供ARO DSL开发者使用 Qwen3.6-27B (OBLITERATUS) 移除拒绝回路,能力保持,本地全栈部署 Ternary-Bonsai-8B (Prism ML) 三元1.58-bit量化8B模型,苹果芯片本地推理 Bonsai-8B-mlx-1bit (PrismML) Apple Silicon 的 1-bit LLM,端侧极低内存推理 HRM-Text-1B (sapientinc) 1B预对齐前缀LM,用前缀条件做结构化输出与推理 Minimalism (salakash) 为开发者输出最少代码行的可运行代码 Nandi-Mini-600M (FrontiersMind) 600M参数早期检查点,面向低资源多语言部署