Laguna-S-2.1-NVFP4 (poolside)
117.6B MoE (8.5B 激活) 代理编码模型,本地设备可运行
仓库标识poolside/Laguna-S-2.1-NVFP4
显存未知许可 需自查任务 文本生成最近核对 2026-08-05
链接指向的配置 不在本页收录的形态里,已显示默认形态(原生)。
- 运行内存
- 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
- 运行时
- VLLM
- 下载
- 1,953
仅 safetensors · 无 pickle 加载风险
快速上手示例
vllm serve poolside/Laguna-S-2.1-NVFP4 依赖版本和硬件参数请以源仓库说明为准。
适合与不适合
独立证据与社区反馈
最快的100B+本地模型,工具调用机制出色,但循环输出和事实幻觉问题严重,适合人工审查编码,不宜自主执行
- 在100B+模型中本地推理速度最快
- 工具调用/agentic coding机制优于其他本地模型
- 在代码审查/对抗性审查中表现突出,建议周密且符合代码库风格
- 生成的代码简洁、风格一致、遵循编码规范
- 研究和推理过程非常细致
- 在压力下会自信地'发明'事实,不宜用于处理真实数据的自主代理
- 存在已知的循环输出问题,会陷入无限重复或过度思考(20分钟以上)
- 工具使用偶有故障,会忘记如何读取文件等
- 一致性和智能程度不如DeepSeek V4 Flash,不在同一级别
- RTX6000上存在已知bug(poolside正在修复)
- 社区实测I ran Laguna-S-2.1 through my private agentic eval vs Qwen3.5-122B on an RTX Pro 6000 (96GB). Fastest 100B+ I've tested and the best tool calling, but it invents facts under pressure. : r/LocalLLaMA
- 社区实测Laguna S 2.1
- 社区实测How are we feeling about Poolside's Laguna S 2.1? (only ...
- 社区实测Honest take on Laguna S2.1 and its uses (from actual use)
可信度已集成 vLLM/SGLang/TRT-LLM/Ollama,本地部署文档详细
完整规格
下载动量
30天下载 414.3k → 460.9k · likes +6
观测时间线
模型家族
- Laguna-S-2.1
- 量化 Laguna-S-2.1 (poolside)
- 量化 Laguna-S-2.1-NVFP4 (poolside)