闲社服务运行正常AI智能体自动化平台

Qwen-Image-Edit-InScene

peteromallet/Qwen-Image-Edit-InScene

发布机构peteromallet

下载访问条件魔搭来源

InScene和InScene Annotate是QwenEdit的LoRA微调模型,用于根据场景参考图像生成新图像。InScene为主模型,可基于参考图像的场景构图和布局生成全新的镜头;InScene Annotate为辅助模型,支持通过绿色矩形标记来控制图像生成区域。 根据参考图像的场景构图和空间布局生成图像 在保持角色一致性和场景连贯性的前提下创建全新镜头

图片生成
模型详情

模型介绍

中文整理

# QwenEdit InScene LoRAs

模型用途

InScene和InScene Annotate是QwenEdit的LoRA微调模型,用于根据场景参考图像生成新图像。InScene为主模型,可基于参考图像的场景构图和布局生成全新的镜头;InScene Annotate为辅助模型,支持通过绿色矩形标记来控制图像生成区域。

## 主要能力

  • 根据参考图像的场景构图和空间布局生成图像
  • 在保持角色一致性和场景连贯性的前提下创建全新镜头
  • 理解元素之间的空间关系
  • 强提示词遵循能力,支持场景感知生成
  • InScene Annotate支持通过标注区域进行精确控制

## 输入输出

  • *输入**:参考图像加提示词(InScene);带绿色矩形标记的参考图像加提示词(InScene Annotate)
  • *输出**:生成的图像

运行要求

需要使用Qwen-Image-Edit基础模型、VAE、文本编码器和Lightning LoRA。可通过ComfyUI或diffusers使用。

基本用法

  • *InScene**:提示词以"Show a different image in the same scene of: "开头,后接期望生成内容的描述。
  • *InScene Annotate**:在参考图像上用绿色矩形标记主体或感兴趣区域,然后描述期望的聚焦内容和变化。

限制

  • 复杂多层场景和大量元素的处理可能不佳
  • 极度抽象或非传统场景构图可能影响效果
  • 与参考场景布局冲突的细节可能处理困难
  • 偶尔可能出现深度感知问题

许可证

许可证信息未在原文中提供。

优先采用原作者提供的中文模型卡片;仅有英文说明时由闲社AI翻译整理。重要参数、许可证和商用范围请以原文为准。

你将获得什么

完整仓库方式包含该固定版本中的权重、配置、分词器及说明文件;指定版本方式只下载所选文件或整组分片。多模态模型的投影文件、配置等依赖,请按作者说明配齐。

完整仓库可能包含多个权重格式,因此需要的磁盘空间可能大于单一格式的模型大小。下载文件不等于完成模型部署。

使用前须知

运行环境

运行模型需要的设备、工具与依赖,以原作者说明为准。

授权范围

是否允许商用、修改和分发,请查看模型许可证。

闲社提供资料与镜像下载方法,不代表已运行模型或完成安全审计。下载的代码应先检查,再执行。

返回顶部