模型介绍
中文整理模型用途
Mistral Medium 3.5 是 Mistral 首款旗舰级合并模型。这是一款拥有 256k 上下文窗口的 128B 参数密集模型,能够在同一组权重中处理指令遵循、推理和编码任务。该模型取代了 Le Chat 中的 Mistral Medium 3.1 和 Magistral,以及编码代理 Vibe 中的 Devstral 2。与此前发布的模型相比,新统一模型在指令遵循、推理和编码任务上均实现了更优性能。
主要能力
架构特点:
- 128B 参数密集模型
- 256k 上下文长度
- 多模态输入:支持文本和图像输入,文本输出
- 指令和推理功能,支持函数调用,推理强度可按请求配置
核心功能:
- 推理模式:可在快速回复模式和推理模式之间切换,复杂请求时可使用测试时计算提升性能
- 视觉能力:分析图像并基于视觉内容提供洞察
- 多语言支持:支持数十种语言,包括英语、法语、西班牙语、德语、意大利语、葡萄牙语、荷兰语、中文、日语、韩语和阿拉伯语
- 系统提示:强支持系统提示词
- 代理能力:原生函数调用和 JSON 输出的顶级代理能力
- 大上下文窗口:支持 256k 上下文
性能表现:
- τ³-Telecom 基准测试得分 91.4%
- SWE-Bench Verified 得分 77.6%
输入输出
- 输入:文本和图像
- 输出:文本
运行要求
推荐使用 vLLM 库进行生产级推理。需安装 vllm nightly 版本,自动依赖 mistral common >= 1.11.1 和 transformers >= 5.4.0。
其他支持的推理框架包括:
- llama.cpp
- Ollama
- SGLang
- transformers
- LM studio(开发中)
基本用法
推理强度设置:
- 'none':不使用推理
- 'high':使用推理(推荐用于复杂提示词和代理场景)
温度设置:
- 推理强度为 'high' 时使用 0.7
- 推理强度为 'none' 时使用 0.0 至 0.7 之间的值,视任务而定
Top p 设置:
- 推理强度为 'high' 时使用 0.95
- 推理强度为 'none' 时设为 None 或 1.0
限制
请确保使用包含修复的 Transformers 配置。之前的配置存在错误,会导致长上下文性能下降。使用旧配置生成的 GGUF 文件也会受到影响。
许可证
本模型采用修改版 MIT 许可证授权:允许商业和非商业使用,但对收入较高的公司有例外条款。不得以侵犯、违反任何第三方权利(包括知识产权)的方式使用本模型。
优先采用原作者提供的中文模型卡片;仅有英文说明时由闲社AI翻译整理。重要参数、许可证和商用范围请以原文为准。
你将获得什么
完整仓库方式包含该固定版本中的权重、配置、分词器及说明文件;指定版本方式只下载所选文件或整组分片。多模态模型的投影文件、配置等依赖,请按作者说明配齐。
完整仓库可能包含多个权重格式,因此需要的磁盘空间可能大于单一格式的模型大小。下载文件不等于完成模型部署。
使用前须知
运行模型需要的设备、工具与依赖,以原作者说明为准。
是否允许商用、修改和分发,请查看模型许可证。
闲社提供资料与镜像下载方法,不代表已运行模型或完成安全审计。下载的代码应先检查,再执行。
资料或下载有问题?
登录后可提交反馈。
