模型介绍
中文整理Pixtral-12B-Base-2409
模型用途
这是Pixtral-12B-2409的预训练基础模型,由12B参数的多模态解码器和400M参数的视觉编码器组成。
主要能力
原生多模态模型,使用交错的图像和文本数据进行训练。支持可变图像尺寸。在其参数规模级别的多模态任务中表现领先,同时在纯文本基准测试中保持最先进性能。序列长度支持128k tokens。
输入输出
支持交错的图像和文本输入,输出文本内容。
运行要求
推荐使用vLLM库进行推理,需确保vLLM版本不低于v0.6.2,mistral common版本不低于1.4.4。也可使用mistral-inference库,需版本不低于1.4.1。提供可用的Docker镜像。
基本用法
推荐使用vLLM库实现生产级推理流水线。也可使用mistral-inference库进行快速测试和验证。
限制
该模型没有任何内容审核机制。团队期待与社区合作,探索如何让模型能够精细地遵守防护栏,以便部署在需要内容审核的环境中。
许可证
Apache 2.0
优先采用原作者提供的中文模型卡片;仅有英文说明时由闲社AI翻译整理。重要参数、许可证和商用范围请以原文为准。
你将获得什么
完整仓库方式包含该固定版本中的权重、配置、分词器及说明文件;指定版本方式只下载所选文件或整组分片。多模态模型的投影文件、配置等依赖,请按作者说明配齐。
完整仓库可能包含多个权重格式,因此需要的磁盘空间可能大于单一格式的模型大小。下载文件不等于完成模型部署。
使用前须知
运行模型需要的设备、工具与依赖,以原作者说明为准。
是否允许商用、修改和分发,请查看模型许可证。
闲社提供资料与镜像下载方法,不代表已运行模型或完成安全审计。下载的代码应先检查,再执行。
资料或下载有问题?
登录后可提交反馈。
