模型详情
模型介绍
中文整理Qwen3-Embedding-8B
模型用途
Qwen3-Embedding-8B是阿里云Qwen团队开发的文本嵌入模型,专门用于文本嵌入和排序任务。该模型基于Qwen3系列密集基础模型构建,可应用于文本检索、代码检索、文本分类、文本聚类、双语文本挖掘等多种场景。
主要能力
该模型在MTEB多语言排行榜上排名第一(截至2025年6月5日,分数70.58)。支持超过100种语言,包括多种编程语言,具备强大的多语言、跨语言和代码检索能力。模型继承了大语言模型的卓越多语言能力、长文本理解和推理能力。嵌入维度最高支持4096维,并支持用户自定义输出维度(范围32至4096)。模型支持MRL(多维缩放)功能,可灵活调整嵌入维度。同时支持指令微调,使用自定义指令可针对特定任务、语言或场景提升性能。
输入输出
输入:文本序列,支持用户自定义指令
输出:嵌入向量,维度最高4096
上下文长度:32K tokens
运行要求
参数规模:8B
层数:36
序列长度:32K
基本用法
建议开发者根据具体场景、任务和语言自定义指令。评估表明,在大多数检索场景中,不使用指令可能导致检索性能下降约1%至5%。在多语言场景下,建议使用英文编写指令,因为模型训练过程中使用的大多数指令原本为英文。
限制
模型性能受指令质量影响,建议针对具体任务场景定制指令以获得最佳效果。
许可证
如需引用该模型,请按相关引用格式标注。
优先采用原作者提供的中文模型卡片;仅有英文说明时由闲社AI翻译整理。重要参数、许可证和商用范围请以原文为准。
你将获得什么
完整仓库方式包含该固定版本中的权重、配置、分词器及说明文件;指定版本方式只下载所选文件或整组分片。多模态模型的投影文件、配置等依赖,请按作者说明配齐。
完整仓库可能包含多个权重格式,因此需要的磁盘空间可能大于单一格式的模型大小。下载文件不等于完成模型部署。
使用前须知
运行环境运行模型需要的设备、工具与依赖,以原作者说明为准。
授权范围是否允许商用、修改和分发,请查看模型许可证。
闲社提供资料与镜像下载方法,不代表已运行模型或完成安全审计。下载的代码应先检查,再执行。
资料或下载有问题?
登录后可提交反馈。