模型介绍
中文整理MagenticBrain 模型卡片
模型用途
MagenticBrain 是微软研究院 AI Frontiers 开发的 140 亿参数编排模型,用于规划多步骤任务、调用声明的工具并协调子代理。该模型本身不执行实际操作,所有真实世界的副作用都发生在宿主框架内。
主要能力
编排优先的后训练:专门用于规划、工具选择、多轮工具链和子代理委托。不是通用聊天模型。
结构化工具调用:工具模式在推理时传入,模型仅从已声明的工具中选择,不会自行发明新工具。
子代理委托:内置显式交接轨迹,可委托给 Fara1.5-9B 计算机使用子代理。
提交终止协议:每个任务以专用提交信号结束,作为协议标记而非动作,框架以此作为任务结束指示器。
32K 上下文:足以容纳系统提示、工具模式和多轮轨迹状态。
基于 Qwen3-14B:继承基础模型的推理和指令遵循能力。
输入输出
输入:文本(系统提示、工具模式、用户目标、轨迹状态)
输出:文本和结构化 JSON 工具调用
运行要求
推荐部署环境:MagenticLite
MagenticBrain 是 MagenticLite 内部的编排模型。训练组合、工具调用格式和提交终止协议都与 MagenticLite 的执行循环校准。若要获得 MagenticBrain 训练时的行为,请在 MagenticLite 内运行。
权重可在任何兼容运行时加载(Transformers、vLLM、SGLang、TensorRT-LLM)。使用 Transformers 时需要 transformers >= 4.51.0。
MagenticBrain 以非思考模式运行,需在聊天模板中保持 enable thinking=False。不使用贪婪解码,该模型系列会导致无限重复。如需更严格、更确定性的工具选择,请降低温度。
基本用法
使用 Transformers 时,模型以 JSON 对象形式输出工具调用。解析这些调用,在宿主中执行工具,将结果作为工具角色消息反馈,然后再次调用 generate。循环直到模型输出 submit。
使用 vLLM 时,通过 OpenAI 兼容端点提供服务,暴露工具调用功能。使用 tools=[...] 调用 /v1/chat/completions,传递聊天模板参数 kwargs={"enable thinking": false} 以匹配训练时的默认设置。
限制
主要用途:工具编排和工作流规划、宿主内的代理任务协调、代理系统的研究和产品实验。
不在范围内:完全自主的代理、开放域消费者聊天、依赖 emergent 工具发明或自我修改的系统、业务决策、产品逻辑或用户政策方面的权威决策。
在声明的工具模式外使用、缺少宿主控制的执行边界、或部署中绕过敏感操作的人机确认,这些均不受支持,且超出了模型评估的条件。
已知风险领域包括:未经授权或有害的工具行动、过度自主和人类监督缺失、幻觉计划或违反政策的建议、来自基础模型预训练的数据来源、隐私和知识产权风险。
许可证
MIT 许可证。仅发布权重,不包含推理代码、执行框架、训练配方和超参数。
优先采用原作者提供的中文模型卡片;仅有英文说明时由闲社AI翻译整理。重要参数、许可证和商用范围请以原文为准。
你将获得什么
完整仓库方式包含该固定版本中的权重、配置、分词器及说明文件;指定版本方式只下载所选文件或整组分片。多模态模型的投影文件、配置等依赖,请按作者说明配齐。
完整仓库可能包含多个权重格式,因此需要的磁盘空间可能大于单一格式的模型大小。下载文件不等于完成模型部署。
使用前须知
运行模型需要的设备、工具与依赖,以原作者说明为准。
是否允许商用、修改和分发,请查看模型许可证。
闲社提供资料与镜像下载方法,不代表已运行模型或完成安全审计。下载的代码应先检查,再执行。
资料或下载有问题?
登录后可提交反馈。
