闲社服务运行正常AI智能体自动化平台

Mistral-Medium-3.5-128B

mistralai/Mistral-Medium-3.5-128B

发布机构Mistral AI已核实

下载访问条件国内镜像可用

Mistral Medium 3.5 是 Mistral 首款旗舰级合并模型。这是一款拥有 256k 上下文窗口的 128B 参数密集模型,能够在同一组权重中处理指令遵循、推理和编码任务。该模型取代了 Le Chat 中的 Mistral Medium 3.1 和 Magistral,以及编码代理 Vibe 中的 Devstral 2。与此前发布的模型相比,新统一模型在指令遵循、推理和编码任务上均实现了更优性能。 多模态输入:支持文本和图像输入,文本输出

文字对话图文理解推理思考
模型详情

模型介绍

中文整理

模型用途

Mistral Medium 3.5 是 Mistral 首款旗舰级合并模型。这是一款拥有 256k 上下文窗口的 128B 参数密集模型,能够在同一组权重中处理指令遵循、推理和编码任务。该模型取代了 Le Chat 中的 Mistral Medium 3.1 和 Magistral,以及编码代理 Vibe 中的 Devstral 2。与此前发布的模型相比,新统一模型在指令遵循、推理和编码任务上均实现了更优性能。

主要能力

架构特点:

  • 128B 参数密集模型
  • 256k 上下文长度
  • 多模态输入:支持文本和图像输入,文本输出
  • 指令和推理功能,支持函数调用,推理强度可按请求配置

核心功能:

  • 推理模式:可在快速回复模式和推理模式之间切换,复杂请求时可使用测试时计算提升性能
  • 视觉能力:分析图像并基于视觉内容提供洞察
  • 多语言支持:支持数十种语言,包括英语、法语、西班牙语、德语、意大利语、葡萄牙语、荷兰语、中文、日语、韩语和阿拉伯语
  • 系统提示:强支持系统提示词
  • 代理能力:原生函数调用和 JSON 输出的顶级代理能力
  • 大上下文窗口:支持 256k 上下文

性能表现:

  • τ³-Telecom 基准测试得分 91.4%
  • SWE-Bench Verified 得分 77.6%

输入输出

  • 输入:文本和图像
  • 输出:文本

运行要求

推荐使用 vLLM 库进行生产级推理。需安装 vllm nightly 版本,自动依赖 mistral common >= 1.11.1 和 transformers >= 5.4.0。

其他支持的推理框架包括:

  • llama.cpp
  • Ollama
  • SGLang
  • transformers
  • LM studio(开发中)

基本用法

推理强度设置:

  • 'none':不使用推理
  • 'high':使用推理(推荐用于复杂提示词和代理场景)

温度设置:

  • 推理强度为 'high' 时使用 0.7
  • 推理强度为 'none' 时使用 0.0 至 0.7 之间的值,视任务而定

Top p 设置:

  • 推理强度为 'high' 时使用 0.95
  • 推理强度为 'none' 时设为 None 或 1.0

限制

请确保使用包含修复的 Transformers 配置。之前的配置存在错误,会导致长上下文性能下降。使用旧配置生成的 GGUF 文件也会受到影响。

许可证

本模型采用修改版 MIT 许可证授权:允许商业和非商业使用,但对收入较高的公司有例外条款。不得以侵犯、违反任何第三方权利(包括知识产权)的方式使用本模型。

优先采用原作者提供的中文模型卡片;仅有英文说明时由闲社AI翻译整理。重要参数、许可证和商用范围请以原文为准。

你将获得什么

完整仓库方式包含该固定版本中的权重、配置、分词器及说明文件;指定版本方式只下载所选文件或整组分片。多模态模型的投影文件、配置等依赖,请按作者说明配齐。

完整仓库可能包含多个权重格式,因此需要的磁盘空间可能大于单一格式的模型大小。下载文件不等于完成模型部署。

使用前须知

运行环境

运行模型需要的设备、工具与依赖,以原作者说明为准。

授权范围

是否允许商用、修改和分发,请查看模型许可证。

闲社提供资料与镜像下载方法,不代表已运行模型或完成安全审计。下载的代码应先检查,再执行。

返回顶部