模型详情
模型介绍
中文整理# QwenEdit InScene LoRAs
模型用途
InScene和InScene Annotate是QwenEdit的LoRA微调模型,用于根据场景参考图像生成新图像。InScene为主模型,可基于参考图像的场景构图和布局生成全新的镜头;InScene Annotate为辅助模型,支持通过绿色矩形标记来控制图像生成区域。
## 主要能力
- 根据参考图像的场景构图和空间布局生成图像
- 在保持角色一致性和场景连贯性的前提下创建全新镜头
- 理解元素之间的空间关系
- 强提示词遵循能力,支持场景感知生成
- InScene Annotate支持通过标注区域进行精确控制
## 输入输出
- *输入**:参考图像加提示词(InScene);带绿色矩形标记的参考图像加提示词(InScene Annotate)
运行要求
需要使用Qwen-Image-Edit基础模型、VAE、文本编码器和Lightning LoRA。可通过ComfyUI或diffusers使用。
基本用法
- *InScene**:提示词以"Show a different image in the same scene of: "开头,后接期望生成内容的描述。
- *InScene Annotate**:在参考图像上用绿色矩形标记主体或感兴趣区域,然后描述期望的聚焦内容和变化。
限制
- 复杂多层场景和大量元素的处理可能不佳
- 极度抽象或非传统场景构图可能影响效果
- 与参考场景布局冲突的细节可能处理困难
- 偶尔可能出现深度感知问题
许可证
许可证信息未在原文中提供。
优先采用原作者提供的中文模型卡片;仅有英文说明时由闲社AI翻译整理。重要参数、许可证和商用范围请以原文为准。
你将获得什么
完整仓库方式包含该固定版本中的权重、配置、分词器及说明文件;指定版本方式只下载所选文件或整组分片。多模态模型的投影文件、配置等依赖,请按作者说明配齐。
完整仓库可能包含多个权重格式,因此需要的磁盘空间可能大于单一格式的模型大小。下载文件不等于完成模型部署。
使用前须知
运行环境运行模型需要的设备、工具与依赖,以原作者说明为准。
授权范围是否允许商用、修改和分发,请查看模型许可证。
闲社提供资料与镜像下载方法,不代表已运行模型或完成安全审计。下载的代码应先检查,再执行。
资料或下载有问题?
登录后可提交反馈。