模型介绍
中文整理模型名称:microsoft/UserLM-8b
模型用途
UserLM-8b 是一款用户模拟语言模型,与大多数训练为“助手”角色的对话模型不同,它经过训练用于模拟对话中的“用户”角色。该模型可用于模拟更真实的对话场景,帮助开发更鲁棒的助手系统。
主要能力
根据给定的任务意图,UserLM-8b 可生成以下内容:首轮用户发言、基于对话状态的后续用户发言、以及表示对话已完成的终止标记。
输入输出输入:任务意图(task intent),定义用户模拟器应追求的高层次目标。
输出:用户发言内容或对话终止标记。
运行要求
该模型基于 Llama3-8b-Base 进行全参数微调训练。训练配置如下:最大序列长度 2048 个 token,批次大小 1024 个样本,学习率 2e-5。训练使用四块 NVIDIA RTX A6000 GPU,共计训练 227 小时。
基本用法
该模型发布供评估助手 LLM 的研究人员使用。UserLM-8b 可用于模拟多轮对话,帮助评估助手 LLM 在真实用户场景下的表现。研究人员可参考论文第 4 节了解评估框架的实现方式。
限制
UserLM-8b 不是助手模型,不适合需要任务帮助的终端用户使用。
该模型虽然能更鲁棒地遵循用户角色和任务意图,但鲁棒性未达到 100%,可能偶尔偏离设定角色或任务意图。
模型可能产生幻觉,引入任务意图中未提供的新要求或约束。这既可能有助于多样化模拟条件,也可能与原任务意图产生冲突。
模型设计并测试仅针对英语,其他语言性能可能有所不同。
模型继承其基础模型和训练数据中可能存在的偏见、错误或遗漏。
目前尚无系统性安全防护措施防止间接提示注入等攻击,使用该模型的系统需自行采取加固措施。
许可证
该模型仅发布用于研究目的。不建议在商业或现实世界应用中使用,除非进行进一步测试和开发。
优先采用原作者提供的中文模型卡片;仅有英文说明时由闲社AI翻译整理。重要参数、许可证和商用范围请以原文为准。
你将获得什么
完整仓库方式包含该固定版本中的权重、配置、分词器及说明文件;指定版本方式只下载所选文件或整组分片。多模态模型的投影文件、配置等依赖,请按作者说明配齐。
完整仓库可能包含多个权重格式,因此需要的磁盘空间可能大于单一格式的模型大小。下载文件不等于完成模型部署。
使用前须知
运行模型需要的设备、工具与依赖,以原作者说明为准。
是否允许商用、修改和分发,请查看模型许可证。
闲社提供资料与镜像下载方法,不代表已运行模型或完成安全审计。下载的代码应先检查,再执行。
资料或下载有问题?
登录后可提交反馈。
