模型介绍
中文整理DeepSeek-V3.1-Terminus 模型卡片
模型简介
DeepSeek-V3.1-Terminus 是 DeepSeek-V3.1 的更新版本。该版本在保持模型原有能力的基础上,针对用户反馈的问题进行了修复和优化。
主要能力
该模型在推理模式和Agent工具使用两个方面的基准测试表现如下:
推理模式基准测试
MMLU-Pro:85.0
GPQA-Diamond:80.7
Humanity's Last Exam:21.7
LiveCodeBench:74.9
Codeforces:2046
Aider-Polyglot:76.1
Agent工具使用基准测试
BrowseComp:38.5
BrowseComp-zh:45.0
SimpleQA:96.8
SWE Verified:68.4
SWE-bench Multilingual:57.8
Terminal-bench:36.7
优化内容
语言一致性:减少了中英文混排现象及异常字符问题。
Agent能力:进一步优化了代码Agent和搜索Agent的性能。
运行要求
模型结构与 DeepSeek-V3 相同。运行本地部署的详细要求请参考 DeepSeek-V3 仓库。
基本用法
搜索Agent的聊天模板请参考 DeepSeek-V3.1 仓库。推理演示代码位于 inference 文件夹中,可帮助用户快速上手运行模型并了解模型架构细节。
已知限制
当前模型权重中,self attn.o proj 参数不符合 UE8M0 FP8 缩放数据格式。该问题已知,将在后续版本中修复。
许可证
本仓库及模型权重采用 MIT 许可证。
优先采用原作者提供的中文模型卡片;仅有英文说明时由闲社AI翻译整理。重要参数、许可证和商用范围请以原文为准。
你将获得什么
完整仓库方式包含该固定版本中的权重、配置、分词器及说明文件;指定版本方式只下载所选文件或整组分片。多模态模型的投影文件、配置等依赖,请按作者说明配齐。
完整仓库可能包含多个权重格式,因此需要的磁盘空间可能大于单一格式的模型大小。下载文件不等于完成模型部署。
使用前须知
运行模型需要的设备、工具与依赖,以原作者说明为准。
是否允许商用、修改和分发,请查看模型许可证。
闲社提供资料与镜像下载方法,不代表已运行模型或完成安全审计。下载的代码应先检查,再执行。
资料或下载有问题?
登录后可提交反馈。
