# Gemini Omni 多模态交互计划
Gemini Omni 1.1 Flash 支持文本、图片、音频和视频输入,并可通过多轮交互生成或编辑视频。这个技能把任务意图、输入顺序、媒体角色、输出时长、分辨率、帧率和人工授权确认固定成离线计划,避免把编辑视频、延展视频和首尾帧插值混用。
ready_for_interaction_review;失败时状态为 blocked 并返回非零退出码gemini-omni-1.1-flash;意图只能是 generate、edit、extend 或 interpolate。extend 必须有视频输入;interpolate 必须有 start 与 end 两张图片;generate 至少要有文本或图片输入。preserve 保留项和 change 修改项,且 rights_reviewed 为 true。parent_interaction_id;首轮计划不能伪造父交互 ID。本技能不上传文件、不调用 Interactions API、不校验 Google 账号和额度、不读取视频帧、不判断模型是否真的遵循提示词。模型版本、接口字段、输入限制、存储和计费以操作者当前官方页面及账号返回为准。
CODEBLOCK0
请通过上方所属套餐查看交付内容与下载方式。
下载不等于安装成功,运行环境、平台适配和外部服务需按说明准备。
此处不单独展示技能价格,请以上方所属套餐价格为准。