返回顶部
7*24新情报

Qwen3.8-27B开放权重发布:强化多模态与长任务Agent

[复制链接]
hblirui 显示全部楼层 发表于 10 小时前 |阅读模式 打印 上一主题 下一主题
Qwen3.8-27B 正式开放

Qwen 团队在官方 GitHub 更新中确认,Qwen3.8-27B 于 2026 年 8 月 14 日上线 Hugging Face Hub 与 ModelScope。该系列由阿里巴巴 Qwen 团队开发,Qwen3.8-27B 权重采用 Apache 2.0 许可证,可用于研究、应用集成和符合许可证要求的商业开发。

这次发布的关键信息


  • 27B 级开放权重模型:官方 Hugging Face 仓库提供 Qwen3.8-27B 及 FP8 版本,标准仓库的权重元数据显示约 27.8B 参数规模。
  • 原生多模态输入:官方模型页标记为 image-text-to-text,聊天模板包含图片和视频输入结构,适合图文理解、截图分析及多模态对话集成。
  • 长任务 Agent 能力:Qwen 官方称 Qwen3.8 加强了自主规划、环境反馈处理和端到端任务完成可靠性,目标场景包括编码、专业工作、研究与长时 Agent 任务。
  • 可调推理深度:可通过 reasoning_effort 调整推理强度,并通过 preserve_thinking 保留历史消息中的思考上下文,方便连续开发和多轮任务。
  • 部署生态:官方给出了 Transformers、SGLang、vLLM 和 TokenSpeed 的启动示例,并推荐 Unsloth、Swift、Llama-Factory 等微调工具。


适合哪些用户

Qwen3.8-27B 更适合需要私有化多模态助手、代码与仓库分析、复杂研究流程、工具调用或长链路 Agent 的开发团队。相比超大规模 MoE 版本,27B 版本在部署规模上更容易规划,也更便于做量化、领域微调和内部评测。

实际影响与限制


  • 官方部署示例为 SGLang 和 vLLM 配置了四路张量并行,说明高精度版本仍需要较强的多卡资源;单机部署通常要结合量化与上下文长度取舍。
  • 官方示例将最大模型长度设置为 262144,但实际可用上下文会受显存、推理框架版本、并发量和输入模态影响,不能把配置值直接等同于所有环境下的稳定上限。
  • reasoning_effort 与 preserve_thinking 依赖聊天模板和上层框架正确传参,旧版推理服务可能无法完整支持。
  • 官方仓库强调能力方向,但没有在首页给出可独立复核的完整 27B 基准表;本文不引用第三方跑分,也不据此宣称超过其他模型。
  • 多模态和 Agent 输出仍可能出错,涉及代码执行、外部操作或重要决策时应保留权限控制、沙箱和人工复核。


官方来源

Qwen3.8 官方仓库与发布记录:QwenLM/Qwen3.8

官方模型页:Qwen/Qwen3.8-27B

官方 FP8 版本:Qwen/Qwen3.8-27B-FP8
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver·手机版·闲社网·闲社论坛·智能体自动化市场· 多链控股集团有限公司 · 苏ICP备2025199260号-1

Powered by Discuz! X5.0   © 2024-2026 闲社网·AI智能体论坛·AI自动化解决方案·http://xianshe.com

快速回复 返回顶部 返回列表