闲社服务运行正常AI智能体自动化平台

Qwen3-Embedding-8B-GGUF

Qwen/Qwen3-Embedding-8B-GGUF

发布机构Qwen

下载访问条件魔搭来源

Qwen3-Embedding-8B-GGUF Qwen3-Embedding-8B-GGUF是文本嵌入模型,属于Qwen3嵌入系列。该系列模型专门用于文本嵌入和排序任务,适用于文本检索、代码检索、文本分类、文本聚类、双语文本挖掘等应用场景。 该模型继承Qwen3基础模型的多语言能力、长文本理解和推理能力。支持超过100种语言,包括多种编程语言,提供强大的多语言、跨语言和代码检索能力。在MTEB多语言排行榜上,该8B参数模型排名第一(截至2025年6月5日,分数70.58)。

推理思考编程开发向量检索
模型详情

模型介绍

中文整理

Qwen3-Embedding-8B-GGUF

模型用途

Qwen3-Embedding-8B-GGUF是文本嵌入模型,属于Qwen3嵌入系列。该系列模型专门用于文本嵌入和排序任务,适用于文本检索、代码检索、文本分类、文本聚类、双语文本挖掘等应用场景。

主要能力

该模型继承Qwen3基础模型的多语言能力、长文本理解和推理能力。支持超过100种语言,包括多种编程语言,提供强大的多语言、跨语言和代码检索能力。在MTEB多语言排行榜上,该8B参数模型排名第一(截至2025年6月5日,分数70.58)。同时支持灵活的向量维度定义和用户自定义指令,可针对特定任务、语言或场景优化性能。

输入输出

输入:文本及可选的查询指令

输出:嵌入向量,支持自定义维度(32至4096)

运行要求

参数量:8B

上下文长度:32k

嵌入维度:最高4096,支持用户自定义输出维度(32至4096)

量化选项:q4_K_M、q5_0、q5_K_M、q6_K、q8_0、f16

基本用法

建议使用llama.cpp运行模型。可根据具体场景、任务和语言自定义指令。评估表明,在大多数检索场景中,不使用指令可能导致检索性能下降约1%至5%。在多语言场景下,建议使用英文指令,因为模型训练过程中使用的主要是英文指令。

限制

模型评估显示,使用指令通常比不使用可提升1%至5%的性能。建议开发者针对具体任务和场景创建定制化指令。

许可证

如需引用该工作,请按相关引用格式注明。

优先采用原作者提供的中文模型卡片;仅有英文说明时由闲社AI翻译整理。重要参数、许可证和商用范围请以原文为准。

你将获得什么

完整仓库方式包含该固定版本中的权重、配置、分词器及说明文件;指定版本方式只下载所选文件或整组分片。多模态模型的投影文件、配置等依赖,请按作者说明配齐。

完整仓库可能包含多个权重格式,因此需要的磁盘空间可能大于单一格式的模型大小。下载文件不等于完成模型部署。

使用前须知

运行环境

运行模型需要的设备、工具与依赖,以原作者说明为准。

授权范围

是否允许商用、修改和分发,请查看模型许可证。

闲社提供资料与镜像下载方法,不代表已运行模型或完成安全审计。下载的代码应先检查,再执行。

返回顶部