模型 / Laguna-S-2.1-NVFP4 (poolside)

Laguna-S-2.1-NVFP4 (poolside)

117.6B MoE (8.5B 激活) 代理编码模型,本地设备可运行

作者 poolside

仓库标识poolside/Laguna-S-2.1-NVFP4

显存未知许可 需自查任务 文本生成最近核对 2026-08-05
运行内存
格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
运行时
VLLM
下载
1,953

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

快速上手示例

vllm serve poolside/Laguna-S-2.1-NVFP4

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
Laguna S 2.1 的 NVFP4 量化版,Ollama 一键运行,适合本地部署做编码 agent 任务,但本质是量化版本。
对位
对位 Mixtral-8x7B (12.9B 激活)
适合
代理编码与长周期任务 / 支持工具调用与推理
不适合
通用闲聊或非代码场景

独立证据与社区反馈

4 个独立来源最近验证 2026-08-05

最快的100B+本地模型,工具调用机制出色,但循环输出和事实幻觉问题严重,适合人工审查编码,不宜自主执行

  • 在100B+模型中本地推理速度最快
  • 工具调用/agentic coding机制优于其他本地模型
  • 在代码审查/对抗性审查中表现突出,建议周密且符合代码库风格
  • 生成的代码简洁、风格一致、遵循编码规范
  • 研究和推理过程非常细致
  • 在压力下会自信地'发明'事实,不宜用于处理真实数据的自主代理
  • 存在已知的循环输出问题,会陷入无限重复或过度思考(20分钟以上)
  • 工具使用偶有故障,会忘记如何读取文件等
  • 一致性和智能程度不如DeepSeek V4 Flash,不在同一级别
  • RTX6000上存在已知bug(poolside正在修复)

可信度已集成 vLLM/SGLang/TRT-LLM/Ollama,本地部署文档详细

完整规格

规模
117.6B (8.5B 激活) · 256K · 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
授权
OpenMDW-1.1 · 需自查
框架
vllm / sglang / transformers / trt-llm / ollama / llama.cpp
工具调用
poolside_v1 格式
血统
量化自 Laguna-S-2.1
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 414.3k → 460.9k · likes +6

观测时间线

模型家族

查看全部家族 →