闲社
标题:
上海AI实验室开放Atria Dawn Preview:744B智能体模型面向科研与工程
[打印本页]
作者:
cxw
时间:
4 小时前
标题:
上海AI实验室开放Atria Dawn Preview:744B智能体模型面向科研与工程
## 事件概述
上海人工智能实验室在 Hugging Face 的 InternLM 组织公开 Atria Dawn Preview 预览版模型。其技术报告于 2026 年 9 月 14 日在 arXiv 发布;模型卡则提供了可下载权重、部署说明和评测结果。
## 模型与开发者
- 模型:Atria-Dawn-Preview(另有 FP8 量化 Instruct 权重)
- 开发者:上海人工智能实验室(InternLM)
- 官方时间:技术报告发表于 2026 年 9 月 14 日,模型卡同步说明预览版开放
- 基座:744B 参数 MoE GLM-5.2 基座
- 上下文:256K
- 许可证:MIT
## 关键能力与改动
- 采用 Verifiable Experience Pipeline,把工具交互连接到可执行环境和外部验证结果,训练目标覆盖问题分析、方案设计、代码实现、实验执行、结果分析与失败恢复。
- 面向 Discovery、Creation、Delivery 和 Cybersecurity 四类智能体任务,强调科研自动化、软件工程和办公交付。
- 官方提供 Hugging Face、ModelScope 权重,以及 SGLang v0.5.13.post1+ 和 vLLM v0.23.0+ 的本地部署指南。
## 适用对象
需要长上下文、多步工具调用和可验证产出的科研团队、工程开发者、企业自动化团队,以及希望研究开放权重智能体训练流程的机构。
## 实际影响与限制
Atria Dawn Preview 将研究问题到可复现实验结果的完整流程作为模型目标,并以 MIT 许可证开放权重,便于团队在自有环境中评估和二次开发。它仍是预览版,评测由发布方完成且不同任务表现有差异;模型卡明确说明 Atria-Dawn-Preview 只接受文本输入,不是多模态模型。744B 规模意味着本地部署需要高算力与成熟推理框架,当前也没有公共推理提供商托管;安全相关能力只能在获得授权的环境中使用,实际系统仍需人工监督、工具权限隔离和结果复核。
## 官方来源
Hugging Face 模型卡:https://huggingface.co/internlm/Atria-Dawn-Preview
技术报告:https://arxiv.org/abs/2609.15818
欢迎光临 闲社 (https://www.xianshe.com/)
Powered by Discuz! X5.0