模型介绍
中文整理Qwen3-Embedding-8B-GGUF
模型用途
Qwen3-Embedding-8B-GGUF是文本嵌入模型,属于Qwen3嵌入系列。该系列模型专门用于文本嵌入和排序任务,适用于文本检索、代码检索、文本分类、文本聚类、双语文本挖掘等应用场景。
主要能力
该模型继承Qwen3基础模型的多语言能力、长文本理解和推理能力。支持超过100种语言,包括多种编程语言,提供强大的多语言、跨语言和代码检索能力。在MTEB多语言排行榜上,该8B参数模型排名第一(截至2025年6月5日,分数70.58)。同时支持灵活的向量维度定义和用户自定义指令,可针对特定任务、语言或场景优化性能。
输入输出
输入:文本及可选的查询指令
输出:嵌入向量,支持自定义维度(32至4096)
运行要求
参数量:8B
上下文长度:32k
嵌入维度:最高4096,支持用户自定义输出维度(32至4096)
量化选项:q4_K_M、q5_0、q5_K_M、q6_K、q8_0、f16
基本用法
建议使用llama.cpp运行模型。可根据具体场景、任务和语言自定义指令。评估表明,在大多数检索场景中,不使用指令可能导致检索性能下降约1%至5%。在多语言场景下,建议使用英文指令,因为模型训练过程中使用的主要是英文指令。
限制
模型评估显示,使用指令通常比不使用可提升1%至5%的性能。建议开发者针对具体任务和场景创建定制化指令。
许可证
如需引用该工作,请按相关引用格式注明。
优先采用原作者提供的中文模型卡片;仅有英文说明时由闲社AI翻译整理。重要参数、许可证和商用范围请以原文为准。
你将获得什么
完整仓库方式包含该固定版本中的权重、配置、分词器及说明文件;指定版本方式只下载所选文件或整组分片。多模态模型的投影文件、配置等依赖,请按作者说明配齐。
完整仓库可能包含多个权重格式,因此需要的磁盘空间可能大于单一格式的模型大小。下载文件不等于完成模型部署。
使用前须知
运行模型需要的设备、工具与依赖,以原作者说明为准。
是否允许商用、修改和分发,请查看模型许可证。
闲社提供资料与镜像下载方法,不代表已运行模型或完成安全审计。下载的代码应先检查,再执行。
资料或下载有问题?
登录后可提交反馈。
