模型介绍
中文整理OmniGen:统一图像生成模型
模型用途
OmniGen是一个统一的图像生成模型,能够根据多模态提示生成各种图像。该模型设计简洁、灵活、易于使用,旨在简化图像生成流程,无需加载额外的网络模块或进行复杂的预处理步骤。
主要能力
OmniGen可用于执行多种任务,包括但不限于:文本到图像生成、主体驱动生成、保持身份生成、图像编辑以及基于图像条件的生成。OmniGen无需额外的插件或操作,可根据文本提示自动识别输入图像中的特征,如所需物体、人体姿态、深度图等。
输入输出
输入:多模态提示,包括文本和图像
输出:生成的图像
运行要求
如遇内存不足,可设置offload model=True。当输入多张图像导致推理时间过长时,可减小最大输入图像尺寸。具体资源需求和高效运行方法请参考docs/inference.md。
基本用法
通过GitHub安装使用,也可创建新环境以避免冲突。更多图像生成示例请参考inference.ipynb和inference demo.ipynb。推理参数的详细说明请参考docs/inference.md。
许可证
本仓库基于MIT许可证发布。
优先采用原作者提供的中文模型卡片;仅有英文说明时由闲社AI翻译整理。重要参数、许可证和商用范围请以原文为准。
你将获得什么
所选固定版本的完整仓库文件,包括模型权重、配置、分词器,以及作者提供的说明和其他文件。自动保留目录结构,不需要逐个选择或下载。
完整仓库可能包含多个权重格式,因此需要的磁盘空间可能大于单一格式的模型大小。下载文件不等于完成模型部署。
使用前须知
运行模型需要的设备、工具与依赖,以原作者说明为准。
是否允许商用、修改和分发,请查看模型许可证。
闲社提供资料与镜像下载方法,不代表已运行模型或完成安全审计。下载的代码应先检查,再执行。
资料或下载有问题?
登录后可提交反馈。
