模型介绍
中文整理Z-Image-Turbo 写实光照 LoRA(Flow-DPO)
模型用途
这是一个专门为 Alibaba-Tongyi/Z-Image-Turbo 设计的 LoRA 适配器,通过 Flow-DPO(流匹配直接偏好优化)进行微调,用于显著提升写实光照、电影级阴影和整体图像质量。
主要能力
该 LoRA 能够修复超快速蒸馏模型中常见的“扁平”、“褪色”或“塑料感”问题,仅需 8 步推理即可生成令人惊叹的、物理准确的光照效果。
输入输出
输入:文本提示词
输出:具有增强光照效果的图像
运行要求
基础模型:Alibaba-Tongyi/Z-Image-Turbo(6B 单流 DiT)
推理步数:8 步
混合精度:bfloat16
基本用法
作为文本到图像生成的 LoRA 适配器使用。建议将 LoRA 权重保持在 0.6 至 1.0 之间,以获得最佳写实效果。
限制
此 LoRA 改变的是文本到图像生成的先验分布,设计目的是从文本提示生成更好的原始图像,不可用作图像修复工具来修复用户上传的照片(除非与 RF-Inversion 技术结合使用,但对 8 步模型极不稳定)。
LoRA 权重过高(如超过 1.5)可能导致图像过度锐化或色彩过饱和,这是由于 DPO 边际最大化的特性所致。
引用
如使用该模型或训练方法,请引用:@article{liu2025improving,
title={Improving video generation with human feedback},
author={Liu, Jie and Liu, Gongye and Liang, Jiajun and Yuan, Ziyang and Liu, Xiaokun and Zheng, Mingwu and Wu, Xiele and Wang, Qiulin and Qin, Wenyu and Xia, Menghan and others},
journal={arXiv preprint arXiv:2501.13918},
year={2025}
}
优先采用原作者提供的中文模型卡片;仅有英文说明时由闲社AI翻译整理。重要参数、许可证和商用范围请以原文为准。
你将获得什么
完整仓库方式包含该固定版本中的权重、配置、分词器及说明文件;指定版本方式只下载所选文件或整组分片。多模态模型的投影文件、配置等依赖,请按作者说明配齐。
完整仓库可能包含多个权重格式,因此需要的磁盘空间可能大于单一格式的模型大小。下载文件不等于完成模型部署。
使用前须知
运行模型需要的设备、工具与依赖,以原作者说明为准。
是否允许商用、修改和分发,请查看模型许可证。
闲社提供资料与镜像下载方法,不代表已运行模型或完成安全审计。下载的代码应先检查,再执行。
资料或下载有问题?
登录后可提交反馈。
