闲社服务运行正常AI智能体自动化平台

AquilaChat2-34B

BAAI/AquilaChat2-34B

发布机构北京智源人工智能研究院(BAAI)已核实

已核对来源国内镜像可用

我们开源了我们的 Aquila2 系列,现在包括基础语言模型 Aquila2-7B 和 Aquila2-34B ,对话模型 AquilaChat2-7B 和 AquilaChat2-34B,长文本对话模型AquilaChat2-7B-16k 和 AquilaChat2-34B-16k 基于AquilaChat2-34B初始版本的开发经验,我们对AquilaChat2-34B进行了全面升级并发布1.2版本。评测结果显示,

文字对话
模型详情

模型介绍

中文整理

English

简体中文

Github • WeChat

悟道·天鹰(Aquila2)

我们开源了我们的 **Aquila2** 系列,现在包括基础语言模型 **Aquila2-7B** 和 **Aquila2-34B** ,对话模型 **AquilaChat2-7B** 和 **AquilaChat2-34B**,长文本对话模型**AquilaChat2-7B-16k** 和 **AquilaChat2-34B-16k**

基于AquilaChat2-34B初始版本的开发经验,我们对AquilaChat2-34B进行了全面升级并发布1.2版本。评测结果显示,

AquilaChat2-34B-V1.2 模型在主观评测的8个二级能力维度上,均接近或超过 GPT3.5 水平。

悟道 · 天鹰 Aquila 模型的更多细节将在官方技术报告中呈现。请关注官方渠道更新。

注:发现在预训练任务数据集中存在GSM8K测试数据泄露问题,从评测结果中删除GSM8K的评估结果。

经彻查分析,数据泄露发生于某多次合作数据团队所推荐的数学数据集A(超过2百万样本),其包含未经过处理的GSM8K测试集(1319样本)。团队只进行了常规去重和质量检测,未就是否混入GSM8K测试数据进行额外过滤检查而导致失误,实为工作中的疏漏。

团队一直严格遵循训练数据不能包含测试数据的工作原则。汲取本次因未对外部数据来源进行查证而发生的失误教训,我们在2万亿token全量数据上完成了针对21个测试数据集的排查,所涉数据集包括WTM22(en-zh)、CLUEWSC、winograde、HellaSwag、OpenBookQA、PIQA、ARC-e、BUSTSM、BoolQ、TruthfulQA、RAFT、ChID、EPRSTMT、TNEWS、OCNLI、SEM-Chinese、MMLU、C-Eval、CMMLU、CSL和HumanEval。

快速开始使用 AquilaChat2-34B

使用方式/How to use

  • 推理/Inference

证书/License

Aquila2系列开源模型使用 智源Aquila系列模型许可协议

优先采用原作者提供的中文模型卡片;仅有英文说明时由闲社AI翻译整理。重要参数、许可证和商用范围请以原文为准。

你将获得什么

所选固定版本的完整仓库文件,包括模型权重、配置、分词器,以及作者提供的说明和其他文件。自动保留目录结构,不需要逐个选择或下载。

完整仓库可能包含多个权重格式,因此需要的磁盘空间可能大于单一格式的模型大小。下载文件不等于完成模型部署。

使用前须知

运行环境

运行模型需要的设备、工具与依赖,以原作者说明为准。

授权范围

是否允许商用、修改和分发,请查看模型许可证。

闲社提供资料与镜像下载方法,不代表已运行模型或完成安全审计。下载的代码应先检查,再执行。

返回顶部