闲社
标题:
Qwen3.8-27B开放权重发布:强化多模态与长任务Agent
[打印本页]
作者:
hblirui
时间:
11 小时前
标题:
Qwen3.8-27B开放权重发布:强化多模态与长任务Agent
Qwen3.8-27B 正式开放
Qwen 团队在官方 GitHub 更新中确认,Qwen3.8-27B 于 2026 年 8 月 14 日上线 Hugging Face Hub 与 ModelScope。该系列由阿里巴巴 Qwen 团队开发,Qwen3.8-27B 权重采用 Apache 2.0 许可证,可用于研究、应用集成和符合许可证要求的商业开发。
这次发布的关键信息
27B 级开放权重模型:
官方 Hugging Face 仓库提供 Qwen3.8-27B 及 FP8 版本,标准仓库的权重元数据显示约 27.8B 参数规模。
原生多模态输入:
官方模型页标记为 image-text-to-text,聊天模板包含图片和视频输入结构,适合图文理解、截图分析及多模态对话集成。
长任务 Agent 能力:
Qwen 官方称 Qwen3.8 加强了自主规划、环境反馈处理和端到端任务完成可靠性,目标场景包括编码、专业工作、研究与长时 Agent 任务。
可调推理深度:
可通过 reasoning_effort 调整推理强度,并通过 preserve_thinking 保留历史消息中的思考上下文,方便连续开发和多轮任务。
部署生态:
官方给出了 Transformers、SGLang、vLLM 和 TokenSpeed 的启动示例,并推荐 Unsloth、Swift、Llama-Factory 等微调工具。
适合哪些用户
Qwen3.8-27B 更适合需要私有化多模态助手、代码与仓库分析、复杂研究流程、工具调用或长链路 Agent 的开发团队。相比超大规模 MoE 版本,27B 版本在部署规模上更容易规划,也更便于做量化、领域微调和内部评测。
实际影响与限制
官方部署示例为 SGLang 和 vLLM 配置了四路张量并行,说明高精度版本仍需要较强的多卡资源;单机部署通常要结合量化与上下文长度取舍。
官方示例将最大模型长度设置为 262144,但实际可用上下文会受显存、推理框架版本、并发量和输入模态影响,不能把配置值直接等同于所有环境下的稳定上限。
reasoning_effort 与 preserve_thinking 依赖聊天模板和上层框架正确传参,旧版推理服务可能无法完整支持。
官方仓库强调能力方向,但没有在首页给出可独立复核的完整 27B 基准表;本文不引用第三方跑分,也不据此宣称超过其他模型。
多模态和 Agent 输出仍可能出错,涉及代码执行、外部操作或重要决策时应保留权限控制、沙箱和人工复核。
官方来源
Qwen3.8 官方仓库与发布记录:
QwenLM/Qwen3.8
官方模型页:
Qwen/Qwen3.8-27B
官方 FP8 版本:
Qwen/Qwen3.8-27B-FP8
欢迎光临 闲社 (https://www.xianshe.com/)
Powered by Discuz! X5.0