闲社服务运行正常AI智能体自动化平台

Devstral-Small-2-24B-Instruct-2512

mistralai/Devstral-Small-2-24B-Instruct-2512

发布机构Mistral AI已核实

下载访问条件国内镜像可用

Devstral Small 2 24B Instruct 2512 Devstral 是一款用于软件工程任务的智能大语言模型。Devstral Small 2 擅长使用工具探索代码库、编辑多个文件,为软件工程智能体提供支持。该模型在 SWE-bench 基准测试中表现出色。 智能编码:Devstral 专为智能编码任务设计,是软件工程智能体的理想选择。

编程开发
模型详情

模型介绍

中文整理

Devstral Small 2 24B Instruct 2512

模型用途

Devstral 是一款用于软件工程任务的智能大语言模型。Devstral Small 2 擅长使用工具探索代码库、编辑多个文件,为软件工程智能体提供支持。该模型在 SWE-bench 基准测试中表现出色。

主要能力

智能编码:Devstral 专为智能编码任务设计,是软件工程智能体的理想选择。

轻量级:仅 240 亿参数,可在单张 RTX 4090 或 32GB 内存的 Mac 上运行,适合本地部署和设备端使用。

上下文窗口:256k 上下文窗口。

视觉能力:支持分析图像并基于视觉内容提供洞察。

性能提升:相比前代产品有显著改进。

注意力 Softmax 温度:采用与 Ministral 3 相同的架构,使用 Llama 4 引入的 rope-scaling 和可扩展 Softmax。

更好的泛化能力:对多样化的提示和编码环境具有更好的泛化能力。

输入输出

该模型为指令微调版本(Instruct),经过优化以遵循指令,适用于聊天、智能体和基于指令的软件工程任务。

运行要求

参数规模:240 亿

量化方式:FP8

硬件要求:单张 RTX 4090 或 32GB 内存的 Mac

上下文长度:256k

基本用法

可通过 API 调用或本地部署使用。推荐使用 Mistral Vibe 命令行工具。本地部署支持 vllm(推荐)、sglang、transformers 等框架,也可通过 llama.cpp、LM Studio、Ollama 运行。

限制

不得以侵犯、挪用或以其他方式违反任何第三方权利(包括知识产权)的方式使用本模型。

许可证

Apache 2.0 许可证,允许商业和非商业用途的修改和使用。

优先采用原作者提供的中文模型卡片;仅有英文说明时由闲社AI翻译整理。重要参数、许可证和商用范围请以原文为准。

你将获得什么

完整仓库方式包含该固定版本中的权重、配置、分词器及说明文件;指定版本方式只下载所选文件或整组分片。多模态模型的投影文件、配置等依赖,请按作者说明配齐。

完整仓库可能包含多个权重格式,因此需要的磁盘空间可能大于单一格式的模型大小。下载文件不等于完成模型部署。

使用前须知

运行环境

运行模型需要的设备、工具与依赖,以原作者说明为准。

授权范围

是否允许商用、修改和分发,请查看模型许可证。

闲社提供资料与镜像下载方法,不代表已运行模型或完成安全审计。下载的代码应先检查,再执行。

返回顶部