闲社服务运行正常AI智能体自动化平台

OmniGen-v1

BAAI/OmniGen-v1

发布机构北京智源人工智能研究院(BAAI)已核实

已核对来源国内镜像可用

OmniGen是一个统一的图像生成模型,能够根据多模态提示生成各种图像。该模型设计简洁、灵活、易于使用,旨在简化图像生成流程,无需加载额外的网络模块或进行复杂的预处理步骤。 OmniGen可用于执行多种任务,包括但不限于:文本到图像生成、主体驱动生成、保持身份生成、图像编辑以及基于图像条件的生成。OmniGen无需额外的插件或操作,可根据文本提示自动识别输入图像中的特征,如所需物体、人体姿态、深度图等。 如遇内存不足,可设置offload model=True。当输入多张图像

图文理解图片生成
模型详情

模型介绍

中文整理

OmniGen:统一图像生成模型

模型用途

OmniGen是一个统一的图像生成模型,能够根据多模态提示生成各种图像。该模型设计简洁、灵活、易于使用,旨在简化图像生成流程,无需加载额外的网络模块或进行复杂的预处理步骤。

主要能力

OmniGen可用于执行多种任务,包括但不限于:文本到图像生成、主体驱动生成、保持身份生成、图像编辑以及基于图像条件的生成。OmniGen无需额外的插件或操作,可根据文本提示自动识别输入图像中的特征,如所需物体、人体姿态、深度图等。

输入输出

输入:多模态提示,包括文本和图像

输出:生成的图像

运行要求

如遇内存不足,可设置offload model=True。当输入多张图像导致推理时间过长时,可减小最大输入图像尺寸。具体资源需求和高效运行方法请参考docs/inference.md。

基本用法

通过GitHub安装使用,也可创建新环境以避免冲突。更多图像生成示例请参考inference.ipynb和inference demo.ipynb。推理参数的详细说明请参考docs/inference.md。

许可证

本仓库基于MIT许可证发布。

优先采用原作者提供的中文模型卡片;仅有英文说明时由闲社AI翻译整理。重要参数、许可证和商用范围请以原文为准。

你将获得什么

所选固定版本的完整仓库文件,包括模型权重、配置、分词器,以及作者提供的说明和其他文件。自动保留目录结构,不需要逐个选择或下载。

完整仓库可能包含多个权重格式,因此需要的磁盘空间可能大于单一格式的模型大小。下载文件不等于完成模型部署。

使用前须知

运行环境

运行模型需要的设备、工具与依赖,以原作者说明为准。

授权范围

是否允许商用、修改和分发,请查看模型许可证。

闲社提供资料与镜像下载方法,不代表已运行模型或完成安全审计。下载的代码应先检查,再执行。

返回顶部