模型介绍
中文整理GLM-5.1
模型用途
GLM-5.1是用于智能体工程(agentic engineering)的下一代旗舰模型,专注于增强编码能力。
主要能力
GLM-5.1的编码能力较前代产品显著提升。在SWE-Bench Pro上达到最先进性能,在NL2Repo(仓库生成)和Terminal-Bench 2.0(真实终端任务)上大幅领先GLM-5。
与此前模型不同,GLM-5.1能够在更长时间内保持有效性。早期模型往往在初期快速收益后陷入瓶颈,而GLM-5.1能够处理模糊问题并保持判断准确,在长会话中持续保持生产力。它能够将复杂问题分解、运行实验、读取结果、精准识别障碍。通过反复回顾推理和修订策略,GLM-5.1能够持续优化数百轮交互和数千次工具调用,运行时间越长,结果越优。
基准测试表现
- HLE:31.0
- HLE(带工具):52.3
- AIME 2026:95.3
- HMMT 2025年11月:94.0
- HMMT 2026年2月:82.6
- IMOAnswerBench:83.8
- GPQA-Diamond:86.2
- SWE-Bench Pro:58.4
- NL2Repo:42.7
- Terminal-Bench 2.0(Terminus-2):63.5
- Terminal-Bench 2.0(最佳自报):69.0
- CyberGym:68.7
- BrowseComp:68.0
- BrowseComp(带上下文管理):79.3
- τ³-Bench:70.6
- MCP-Atlas(公开集):71.8
- Tool-Decathlon:40.7
- Vending Bench 2:$5,634.41
输入输出
支持自然语言处理、代码生成、仓库生成、终端任务执行等能力。
运行要求
支持以下开源框架本地部署:
- SGLang(v0.5.10及以上)
- vLLM(v0.19.0及以上)
- xLLM(v0.8.0及以上)
- Transformers(v0.5.3及以上)
- KTransformers(v0.5.3及以上)
基本用法
可通过Z.ai API平台使用GLM-5.1 API服务,也可使用支持的开源框架在本地部署运行。
限制
未提供具体限制信息。
许可证
如在研究中使用GLM-5.1或GLM-5,请引用技术报告。
优先采用原作者提供的中文模型卡片;仅有英文说明时由闲社AI翻译整理。重要参数、许可证和商用范围请以原文为准。
你将获得什么
完整仓库方式包含该固定版本中的权重、配置、分词器及说明文件;指定版本方式只下载所选文件或整组分片。多模态模型的投影文件、配置等依赖,请按作者说明配齐。
完整仓库可能包含多个权重格式,因此需要的磁盘空间可能大于单一格式的模型大小。下载文件不等于完成模型部署。
使用前须知
运行模型需要的设备、工具与依赖,以原作者说明为准。
是否允许商用、修改和分发,请查看模型许可证。
闲社提供资料与镜像下载方法,不代表已运行模型或完成安全审计。下载的代码应先检查,再执行。
资料或下载有问题?
登录后可提交反馈。
