模型详情
模型介绍
中文整理# FireRed-Image-Edit-1.1 模型卡片
模型概述
FireRed-Image-Edit-1.1 是通用图像编辑基础模型的升级版本。基于1.0版本,1.1版本显著增强了身份一致性、多图像条件和领域专业编辑性能,使模型更贴近实际创意生产需求。
## 主要能力
- *编辑性能**
- 最先进的身份一致性:开源模型中角色身份保持的SOTA水平,确保主体在复杂编辑中保持可识别
- 多元素融合:可自由组合10余个元素,配合Agent自动裁剪和拼接功能
- 综合肖像妆容:数十种风格,从专业美颜修图、黄/橄榄肤色提亮到万圣节女巫妆容和创意妆容
- 文字风格参考:保持高保真排版和风格化文字,效果可比肩闭源方案
- 专业照片修复:高质量老照片修复和增强,细节恢复效果优异
- *工程优化**
- 开放LoRA训练生态:完整训练代码发布,支持自定义风格创建,优化采样器最大化GPU效率
- 极致速度优化:完整加速套件包含蒸馏、量化和静态编译,端到端生成仅需4.5秒,显存需求仅30GB
- 智能Agent工作流:自动多图像处理复杂构图,如虚拟试穿,无需冗长的提示词工程
- 通用部署:原生ComfyUI节点支持,GGUF轻量格式兼容,便于生产集成
## 评估结果
FireRed-Image-Edit在Imgedit、Gedit和RedEdit数据集上建立开源模型新SOTA,在特定维度上超越闭源竞争对手。人工评估进一步证实其优越的提示词遵循和视觉一致性表现。
## 输入输出
运行要求
- 显存:30GB VRAM
- 端到端生成时间:约4.5秒
许可证
原始卡片中未包含许可证相关信息。
优先采用原作者提供的中文模型卡片;仅有英文说明时由闲社AI翻译整理。重要参数、许可证和商用范围请以原文为准。
你将获得什么
完整仓库方式包含该固定版本中的权重、配置、分词器及说明文件;指定版本方式只下载所选文件或整组分片。多模态模型的投影文件、配置等依赖,请按作者说明配齐。
完整仓库可能包含多个权重格式,因此需要的磁盘空间可能大于单一格式的模型大小。下载文件不等于完成模型部署。
使用前须知
运行环境运行模型需要的设备、工具与依赖,以原作者说明为准。
授权范围是否允许商用、修改和分发,请查看模型许可证。
闲社提供资料与镜像下载方法,不代表已运行模型或完成安全审计。下载的代码应先检查,再执行。
资料或下载有问题?
登录后可提交反馈。