闲社服务运行正常AI智能体自动化平台

Qwen3.8-27B

Qwen/Qwen3.8-27B

发布机构阿里云通义千问(Qwen)已核实

下载访问条件国内镜像可用

Qwen3.8-27B 是阿里云推出的开源大语言模型系列最新成员,基于 Qwen3.5 架构构建,在编码、专业工作、研究和长程智能体任务方面实现了显著提升。该模型是一个带有视觉编码器的因果语言模型,原生支持图像和视频理解,可处理从 STEM 图表、文档到小时级长度的视频内容。 核心能力:编码、专业工作、研究和长程智能体任务的综合提升。 智能体执行:更强的自主规划能力和环境反馈处理能力,实现更可靠的任务端到端完成。

文字对话图文理解
模型详情

模型介绍

中文整理

Qwen3.8-27B 模型卡片

模型概述

Qwen3.8-27B 是阿里云推出的开源大语言模型系列最新成员,基于 Qwen3.5 架构构建,在编码、专业工作、研究和长程智能体任务方面实现了显著提升。该模型是一个带有视觉编码器的因果语言模型,原生支持图像和视频理解,可处理从 STEM 图表、文档到小时级长度的视频内容。

主要能力

核心能力:编码、专业工作、研究和长程智能体任务的综合提升。

智能体执行:更强的自主规划能力和环境反馈处理能力,实现更可靠的任务端到端完成。

视觉语言理解:原生支持图像和视频理解,涵盖 STEM 图表、文档分析、小时级视频处理等场景。

灵活的思考控制:思考模式默认开启,可按请求禁用;支持通过 reasoning effort 参数调整推理深度;通过 preserve thinking 保留历史消息的推理上下文。

下游兼容性:广泛支持主流评测框架和开发工具,便于集成到现有技术栈。

输入输出

输入格式:纯文本、图像、视频。

输出格式:文本响应。

上下文长度:原生支持 262,144 个 tokens,可扩展至 1,000,000 个 tokens。

运行要求

推理框架:兼容 Hugging Face Transformers、vLLM、SGLang、TokenSpeed 等主流推理框架。

推荐配置:生产环境或高吞吐量场景建议使用 SGLang、vLLM 或 TokenSpeed 等专用推理引擎。

超长文本处理:对于超过 262,144 tokens 的长程任务,建议使用 RoPE 缩放技术(如 YaRN)来处理长文本。

基本用法

采样参数建议:

思考模式:temperature=1.0, top_p=0.95, top_k=20, min_p=0.0, presence_penalty=0.0, repetition_penalty=1.0

指令模式(非思考):temperature=0.7, top_p=0.80, top_k=20, min_p=0.0, presence_penalty=1.5, repetition_penalty=1.0

推理深度控制:支持 reasoning effort 参数调节,包括 xhigh(默认,适用于复杂任务)、medium(平衡准确率和速度)、low(优化速度和成本)。

思考保留:默认启用 preserve thinking,保留所有历史消息的思考块。如需仅保留最新用户消息的思考块,可设置 preserve thinking 为 False。

输出长度建议:对于智能体任务,建议分配充足的输出长度以支持详细和全面的响应。在 1M 上下文长度下,建议推理内容最大输出 262,144 tokens,最终响应最大输出 131,072 tokens。

长视频理解:建议将视频预处理器配置中的最长边参数设置为 469,762,048(对应 224k 视频 tokens),以支持小时级视频的高帧率采样。

限制

推理效率:不同的推理框架在效率和吞吐量方面存在显著差异,建议使用最新版本的框架以确保最佳性能和兼容性。

推理深度与任务完成时间:在多轮智能体任务中,较低的推理深度并不总是减少总体任务完成时间。虽然每轮响应可能更快,但也可能导致分析不足、更多失败和重复重试,从而增加总延迟和 token 消耗。

静态 YaRN 限制:所有主流开源框架实现的静态 YaRN 意味着缩放因子是恒定的,可能影响较短文本的性能。建议仅在处理长上下文时修改 rope 参数配置。

许可证

该模型权重和配置文件以 Hugging Face Transformers 格式提供。许可证信息请参考模型仓库的具体许可条款。

优先采用原作者提供的中文模型卡片;仅有英文说明时由闲社AI翻译整理。重要参数、许可证和商用范围请以原文为准。

你将获得什么

完整仓库方式包含该固定版本中的权重、配置、分词器及说明文件;指定版本方式只下载所选文件或整组分片。多模态模型的投影文件、配置等依赖,请按作者说明配齐。

完整仓库可能包含多个权重格式,因此需要的磁盘空间可能大于单一格式的模型大小。下载文件不等于完成模型部署。

使用前须知

运行环境

运行模型需要的设备、工具与依赖,以原作者说明为准。

授权范围

是否允许商用、修改和分发,请查看模型许可证。

闲社提供资料与镜像下载方法,不代表已运行模型或完成安全审计。下载的代码应先检查,再执行。

返回顶部