闲社服务运行正常AI智能体自动化平台

GLM-5.1

ZhipuAI/GLM-5.1

发布机构ZhipuAI

下载访问条件魔搭来源

GLM-5.1是用于智能体工程(agentic engineering)的下一代旗舰模型,专注于增强编码能力。 GLM-5.1的编码能力较前代产品显著提升。在SWE-Bench Pro上达到最先进性能,在NL2Repo(仓库生成)和Terminal-Bench 2.0(真实终端任务)上大幅领先GLM-5。 与此前模型不同,GLM-5.1能够在更长时间内保持有效性。早期模型往往在初期快速收益后陷入瓶颈,而GLM-5.1能够处理模糊问题并保持判断准确,在长会话中持续保持生产力。它

文字对话推理思考
模型详情

模型介绍

中文整理

GLM-5.1

模型用途

GLM-5.1是用于智能体工程(agentic engineering)的下一代旗舰模型,专注于增强编码能力。

主要能力

GLM-5.1的编码能力较前代产品显著提升。在SWE-Bench Pro上达到最先进性能,在NL2Repo(仓库生成)和Terminal-Bench 2.0(真实终端任务)上大幅领先GLM-5。

与此前模型不同,GLM-5.1能够在更长时间内保持有效性。早期模型往往在初期快速收益后陷入瓶颈,而GLM-5.1能够处理模糊问题并保持判断准确,在长会话中持续保持生产力。它能够将复杂问题分解、运行实验、读取结果、精准识别障碍。通过反复回顾推理和修订策略,GLM-5.1能够持续优化数百轮交互和数千次工具调用,运行时间越长,结果越优。

基准测试表现

  • HLE:31.0
  • HLE(带工具):52.3
  • AIME 2026:95.3
  • HMMT 2025年11月:94.0
  • HMMT 2026年2月:82.6
  • IMOAnswerBench:83.8
  • GPQA-Diamond:86.2
  • SWE-Bench Pro:58.4
  • NL2Repo:42.7
  • Terminal-Bench 2.0(Terminus-2):63.5
  • Terminal-Bench 2.0(最佳自报):69.0
  • CyberGym:68.7
  • BrowseComp:68.0
  • BrowseComp(带上下文管理):79.3
  • τ³-Bench:70.6
  • MCP-Atlas(公开集):71.8
  • Tool-Decathlon:40.7
  • Vending Bench 2:$5,634.41

输入输出

支持自然语言处理、代码生成、仓库生成、终端任务执行等能力。

运行要求

支持以下开源框架本地部署:

  • SGLang(v0.5.10及以上)
  • vLLM(v0.19.0及以上)
  • xLLM(v0.8.0及以上)
  • Transformers(v0.5.3及以上)
  • KTransformers(v0.5.3及以上)

基本用法

可通过Z.ai API平台使用GLM-5.1 API服务,也可使用支持的开源框架在本地部署运行。

限制

未提供具体限制信息。

许可证

如在研究中使用GLM-5.1或GLM-5,请引用技术报告。

优先采用原作者提供的中文模型卡片;仅有英文说明时由闲社AI翻译整理。重要参数、许可证和商用范围请以原文为准。

你将获得什么

完整仓库方式包含该固定版本中的权重、配置、分词器及说明文件;指定版本方式只下载所选文件或整组分片。多模态模型的投影文件、配置等依赖,请按作者说明配齐。

完整仓库可能包含多个权重格式,因此需要的磁盘空间可能大于单一格式的模型大小。下载文件不等于完成模型部署。

使用前须知

运行环境

运行模型需要的设备、工具与依赖,以原作者说明为准。

授权范围

是否允许商用、修改和分发,请查看模型许可证。

闲社提供资料与镜像下载方法,不代表已运行模型或完成安全审计。下载的代码应先检查,再执行。

返回顶部