闲社服务运行正常AI智能体自动化平台

UserLM-8b

microsoft/UserLM-8b

发布机构微软(Microsoft)已核实

下载访问条件国内镜像可用

UserLM-8b 是一款用户模拟语言模型,与大多数训练为“助手”角色的对话模型不同,它经过训练用于模拟对话中的“用户”角色。该模型可用于模拟更真实的对话场景,帮助开发更鲁棒的助手系统。 根据给定的任务意图,UserLM-8b 可生成以下内容:首轮用户发言、基于对话状态的后续用户发言、以及表示对话已完成的终止标记。 输入输出输入:任务意图(task intent),定义用户模拟器应追求的高层次目标。

文字对话
模型详情

模型介绍

中文整理

模型名称:microsoft/UserLM-8b

模型用途

UserLM-8b 是一款用户模拟语言模型,与大多数训练为“助手”角色的对话模型不同,它经过训练用于模拟对话中的“用户”角色。该模型可用于模拟更真实的对话场景,帮助开发更鲁棒的助手系统。

主要能力

根据给定的任务意图,UserLM-8b 可生成以下内容:首轮用户发言、基于对话状态的后续用户发言、以及表示对话已完成的终止标记。

输入输出输入:任务意图(task intent),定义用户模拟器应追求的高层次目标。

输出:用户发言内容或对话终止标记。

运行要求

该模型基于 Llama3-8b-Base 进行全参数微调训练。训练配置如下:最大序列长度 2048 个 token,批次大小 1024 个样本,学习率 2e-5。训练使用四块 NVIDIA RTX A6000 GPU,共计训练 227 小时。

基本用法

该模型发布供评估助手 LLM 的研究人员使用。UserLM-8b 可用于模拟多轮对话,帮助评估助手 LLM 在真实用户场景下的表现。研究人员可参考论文第 4 节了解评估框架的实现方式。

限制

UserLM-8b 不是助手模型,不适合需要任务帮助的终端用户使用。

该模型虽然能更鲁棒地遵循用户角色和任务意图,但鲁棒性未达到 100%,可能偶尔偏离设定角色或任务意图。

模型可能产生幻觉,引入任务意图中未提供的新要求或约束。这既可能有助于多样化模拟条件,也可能与原任务意图产生冲突。

模型设计并测试仅针对英语,其他语言性能可能有所不同。

模型继承其基础模型和训练数据中可能存在的偏见、错误或遗漏。

目前尚无系统性安全防护措施防止间接提示注入等攻击,使用该模型的系统需自行采取加固措施。

许可证

该模型仅发布用于研究目的。不建议在商业或现实世界应用中使用,除非进行进一步测试和开发。

优先采用原作者提供的中文模型卡片;仅有英文说明时由闲社AI翻译整理。重要参数、许可证和商用范围请以原文为准。

你将获得什么

完整仓库方式包含该固定版本中的权重、配置、分词器及说明文件;指定版本方式只下载所选文件或整组分片。多模态模型的投影文件、配置等依赖,请按作者说明配齐。

完整仓库可能包含多个权重格式,因此需要的磁盘空间可能大于单一格式的模型大小。下载文件不等于完成模型部署。

使用前须知

运行环境

运行模型需要的设备、工具与依赖,以原作者说明为准。

授权范围

是否允许商用、修改和分发,请查看模型许可证。

闲社提供资料与镜像下载方法,不代表已运行模型或完成安全审计。下载的代码应先检查,再执行。

返回顶部