模型介绍
中文整理模型名称:Laguna S 2.1
模型用途
Laguna S 2.1 是一款面向代理编程和长周期任务的混合专家模型,属于 Laguna 系列中的中端型号(介于 Laguna XS 2.1 和 Laguna M.1 之间)。该模型专为软件工程场景设计。
主要能力
该模型为118B 总参数的混合专家模型,每个 token 激活约 8B 参数。具备以下核心能力:100 万 token 超长上下文窗口(1,048,576 tokens);原生推理支持,支持工具调用间的交错思考;支持投机解码以降低延迟;混合滑动窗口与全局注意力机制(48 层,12 层全局注意力,36 层滑动窗口注意力,窗口大小 512);支持工具调用功能。
输入输出
输入输出形式为文本到文本。词表大小为 100,352 个 token(Laguna 系列分词器)。
运行要求
模型总计 118B 参数,每 token 激活约 8B 参数。BF16 权重需要多 GPU 部署,约为 236GB 显存。提供多种量化版本(FP8、NVFP4、INT4、GGUF)可大幅降低显存需求。
基本用法
该模型架构与 Laguna XS 2.1 相同,支持主流推理引擎:vLLM、SGLang、Transformers、TRT-LLM、llama.cpp。使用 Ollama 可直接运行,例如:ollama run laguna-s-2.1:q8_0。模型内置 Laguna 聊天模板,自动支持工具调用和交错推理功能。推理功能可通过聊天模板或服务器参数控制。建议在代理编程场景中启用思考功能,并在消息历史中保留推理内容以获得最佳效果。
限制
该模型适用于软件工程和代理编程任务。用户有责任确认模型是否符合其预期用途。使用需遵守 OpenMDW-1.1 许可证及 Poolside 可接受使用政策。建议不要绕过模型的安全防护措施,除非已实施基本等效的缓解措施。
许可证
该模型基于 OpenMDW-1.1 许可证发布,这是一种完全宽松的开源许可证,允许商业和非商业用途的自由使用、修改及商业产品开发,无需额外授权。
优先采用原作者提供的中文模型卡片;仅有英文说明时由闲社AI翻译整理。重要参数、许可证和商用范围请以原文为准。
你将获得什么
完整仓库方式包含该固定版本中的权重、配置、分词器及说明文件;指定版本方式只下载所选文件或整组分片。多模态模型的投影文件、配置等依赖,请按作者说明配齐。
完整仓库可能包含多个权重格式,因此需要的磁盘空间可能大于单一格式的模型大小。下载文件不等于完成模型部署。
使用前须知
运行模型需要的设备、工具与依赖,以原作者说明为准。
是否允许商用、修改和分发,请查看模型许可证。
闲社提供资料与镜像下载方法,不代表已运行模型或完成安全审计。下载的代码应先检查,再执行。
资料或下载有问题?
登录后可提交反馈。
