模型介绍
中文整理# Nex-N2.5 模型卡片
模型概述
Nex-N2.5 是面向真实环境长周期任务的下一代智能体模型系列。该系列包含三种规格:mini、Pro 和 Max。Nex-N2.5-mini 和 Nex-N2.5-Pro 基于 Nex-N2 的多模态基础构建,重点提升了计算机操作、网页浏览和视觉智能体能力。Nex-N2.5-Max 基于 1.6 万亿参数的语言专家混合(MoE)模型,是首次在万亿参数规模上完成的完整后训练。
## 主要能力
Nex-N2.5 针对真实环境中的长周期任务进行了优化,增强了通过视觉反馈进行持续行动和自我修正的能力。模型能够操作计算机和浏览器,自主执行和测试程序。视觉不再仅是输入模态,而是智能体感知环境、验证结果、推进任务的关键界面。
该模型在科学研、知识工作和复杂生产力任务方面有进一步提升,同时首次完成了万亿参数规模的系统后训练。
## 输入输出
支持多模态输入(文本、视觉),输出文本内容。支持函数调用功能。
运行要求
Nex-N2.5-Max:单节点 8 × H100
Nex-N2.5-Pro:单节点 8 × H100
Nex-N2.5-mini:单节点 2 × H100
提供预构建 Docker 镜像:nexagi/sglang:v0.5.18-nex-patch
基本用法
### 采样参数
建议使用以下采样参数以获得最佳生成质量:
- temperature: 0.7
- top p: 0.95
- top k: 40
### 思考模式
通过 reasoning effort 参数控制思考行为:
- "none":非思考模式,直接响应
- "medium"(默认):自适应思考,由模型决定是否及如何思考
- "high":强制思考,始终启用思考
### 函数调用
启用函数调用需添加 --tool-call-parser qwen3 coder 参数
### 推理解析器
模型产生推理轨迹时,需配置 SGLang 将其与最终响应分离:
- Nex-N2.5-mini 和 Nex-N2.5-Pro:--reasoning-parser qwen3
- Nex-N2.5-Max:--reasoning-parser deepseek-r1
许可证
Nex-N2.5 系列模型权重将开源发布,同时提供托管在线服务。
优先采用原作者提供的中文模型卡片;仅有英文说明时由闲社AI翻译整理。重要参数、许可证和商用范围请以原文为准。
你将获得什么
完整仓库方式包含该固定版本中的权重、配置、分词器及说明文件;指定版本方式只下载所选文件或整组分片。多模态模型的投影文件、配置等依赖,请按作者说明配齐。
完整仓库可能包含多个权重格式,因此需要的磁盘空间可能大于单一格式的模型大小。下载文件不等于完成模型部署。
使用前须知
运行模型需要的设备、工具与依赖,以原作者说明为准。
是否允许商用、修改和分发,请查看模型许可证。
闲社提供资料与镜像下载方法,不代表已运行模型或完成安全审计。下载的代码应先检查,再执行。
资料或下载有问题?
登录后可提交反馈。
