闲社服务运行正常AI智能体自动化平台

Magistral-Small-2506_gguf

mistralai/Magistral-Small-2506_gguf

发布机构Mistral AI已核实

下载访问条件国内镜像可用

Magistral-Small-2506 (GGUF) 基于 Mistral Small 3.1 (2503) 构建,增加了推理能力,经过 Magistral Medium 轨迹的监督微调和强化学习训练,是一个高效的小型推理模型,拥有 24B 参数。GGUF 版本为量化模型。 推理能力:能够在给出答案前进行长链推理。

文字对话推理思考
模型详情

模型介绍

中文整理

模型名称

Magistral-Small-2506 (GGUF)

模型用途

基于 Mistral Small 3.1 (2503) 构建,增加了推理能力,经过 Magistral Medium 轨迹的监督微调和强化学习训练,是一个高效的小型推理模型,拥有 24B 参数。GGUF 版本为量化模型。

主要能力

推理能力:能够在给出答案前进行长链推理。

轻量级:仅 240 亿参数,量化后可在单张 RTX 4090 或 32GB 内存的 Mac 上运行,适合本地部署和设备端使用。

上下文窗口:建议设置为 40k。理论上支持更大的 128k 上下文,但未经测试。

分词器:使用 Tekken 分词器,词表大小为 131k。

运行要求

参数规模:240 亿

硬件需求:单张 RTX 4090 或 32GB 内存的 Mac(量化后)

上下文窗口:推荐 40k

基本用法

推荐使用 llama.cpp 运行模型。需添加 --jinja 参数以使用官方分词器。

默认上下文大小为 4096,可增加至 40,960。

建议将 temperature 设置为 0.7,top p 设置为 0.95。

可通过 llama-cli 或 llama-server 与模型交互。

限制

不支持函数调用。

许可证

Apache 2.0 许可证,允许商业和非商业用途的使用及修改。

优先采用原作者提供的中文模型卡片;仅有英文说明时由闲社AI翻译整理。重要参数、许可证和商用范围请以原文为准。

你将获得什么

完整仓库方式包含该固定版本中的权重、配置、分词器及说明文件;指定版本方式只下载所选文件或整组分片。多模态模型的投影文件、配置等依赖,请按作者说明配齐。

完整仓库可能包含多个权重格式,因此需要的磁盘空间可能大于单一格式的模型大小。下载文件不等于完成模型部署。

使用前须知

运行环境

运行模型需要的设备、工具与依赖,以原作者说明为准。

授权范围

是否允许商用、修改和分发,请查看模型许可证。

闲社提供资料与镜像下载方法,不代表已运行模型或完成安全审计。下载的代码应先检查,再执行。

返回顶部