模型介绍
中文整理模型名称
Magistral-Small-2506 (GGUF)
模型用途
基于 Mistral Small 3.1 (2503) 构建,增加了推理能力,经过 Magistral Medium 轨迹的监督微调和强化学习训练,是一个高效的小型推理模型,拥有 24B 参数。GGUF 版本为量化模型。
主要能力
推理能力:能够在给出答案前进行长链推理。
轻量级:仅 240 亿参数,量化后可在单张 RTX 4090 或 32GB 内存的 Mac 上运行,适合本地部署和设备端使用。
上下文窗口:建议设置为 40k。理论上支持更大的 128k 上下文,但未经测试。
分词器:使用 Tekken 分词器,词表大小为 131k。
运行要求
参数规模:240 亿
硬件需求:单张 RTX 4090 或 32GB 内存的 Mac(量化后)
上下文窗口:推荐 40k
基本用法
推荐使用 llama.cpp 运行模型。需添加 --jinja 参数以使用官方分词器。
默认上下文大小为 4096,可增加至 40,960。
建议将 temperature 设置为 0.7,top p 设置为 0.95。
可通过 llama-cli 或 llama-server 与模型交互。
限制
不支持函数调用。
许可证
Apache 2.0 许可证,允许商业和非商业用途的使用及修改。
优先采用原作者提供的中文模型卡片;仅有英文说明时由闲社AI翻译整理。重要参数、许可证和商用范围请以原文为准。
你将获得什么
完整仓库方式包含该固定版本中的权重、配置、分词器及说明文件;指定版本方式只下载所选文件或整组分片。多模态模型的投影文件、配置等依赖,请按作者说明配齐。
完整仓库可能包含多个权重格式,因此需要的磁盘空间可能大于单一格式的模型大小。下载文件不等于完成模型部署。
使用前须知
运行模型需要的设备、工具与依赖,以原作者说明为准。
是否允许商用、修改和分发,请查看模型许可证。
闲社提供资料与镜像下载方法,不代表已运行模型或完成安全审计。下载的代码应先检查,再执行。
资料或下载有问题?
登录后可提交反馈。
