模型详情
模型介绍
中文整理# Mistral-7B-Instruct-v0.2 模型卡片
模型用途
Mistral-7B-Instruct-v0.2 是一个指令微调版本的大型语言模型(LLM),基于 Mistral-7B-v0.2 进行微调。
## 主要能力
该模型具备指令跟随能力,可以根据用户给出的指令生成相应的回复。
## 输入输出
- *输入格式**:提示需要使用 [INST] 和 [/INST] 标记包围。第一个指令应以句子开始标记开头,后续指令不需要。助手回复以句子结束标记终止。
运行要求
- 上下文窗口:32k(相比 v0.1 的 8k 有所扩展)
- Rope-theta:1e6
- 无滑动窗口注意力机制
- 需要 transformers v4.33.4 或更高版本
基本用法
该模型可通过以下方式运行:
- 使用 mistral common 进行推理
- 使用 Hugging Face Transformers 进行推理
限制
- 该模型没有内置任何审查机制
- 模型仅为演示目的,表明基础模型可以通过微调达到较好的性能
- 团队表示期待与社区合作,探索如何让模型更好地遵守安全准则,以适用于需要内容审核的环境
许可证
原始模型卡片中未包含明确的许可证信息。
优先采用原作者提供的中文模型卡片;仅有英文说明时由闲社AI翻译整理。重要参数、许可证和商用范围请以原文为准。
你将获得什么
完整仓库方式包含该固定版本中的权重、配置、分词器及说明文件;指定版本方式只下载所选文件或整组分片。多模态模型的投影文件、配置等依赖,请按作者说明配齐。
完整仓库可能包含多个权重格式,因此需要的磁盘空间可能大于单一格式的模型大小。下载文件不等于完成模型部署。
使用前须知
运行环境运行模型需要的设备、工具与依赖,以原作者说明为准。
授权范围是否允许商用、修改和分发,请查看模型许可证。
闲社提供资料与镜像下载方法,不代表已运行模型或完成安全审计。下载的代码应先检查,再执行。
资料或下载有问题?
登录后可提交反馈。