先规划 Gemini Omni 1.1 Flash 的多模态交互请求,再按多轮编辑的保留项、修改项和人工审片结果决定是否进入交付候选。
## 详细介绍
# Gemini Omni多轮视频编辑门禁工作流
**2个实用技能 · 2步完成 · 每一步都能单独使用**
这套工作流面向 Gemini Omni 1.1 Flash 的视频生成、编辑、延展和首尾帧插值:第一步把文本、图片、音频、视频输入及任务意图整理成 Interactions API 前的离线计划;第二步把多轮交互成功与保留项、修改项、音画观察、人工审片和权属复核拆开验收。它不调用 Google API、不上传或读取媒体、不保存账号信息,也不把“返回视频”误报为“可以交付”。
2个可下载技能 · 每个技能可单独运行
## 2步自动化工作流
### 🔵 1 Gemini Omni 多模态交互计划
技能文件:`gemini-omni-interaction-plan`
**解决什么:** Gemini Omni 的生成、编辑、延展和插值使用不同输入关系;未固定媒体角色、视频时长、输出规格和保留/修改边界,容易把错误请求送入远程额度。
1. 将脱敏 JSON 放入两个技能的 `examples` 或自己的工作目录,先运行交互计划技能。
2. 在自己的 Google AI Studio、Gemini API 或兼容环境完成账号、额度、媒体上传和交互调用,再运行结果验收技能。
3. 只有人工审片、权属复核和费用确认均完成后,才将结果送入自己的剪辑或交付流程。
- [Gemini Omni 多轮结果验收门禁](https://www.xianshe.com/plugin.php?id=hl_skillhub&mod=detail&slug=gemini-omni)
- [Gemini Omni 多模态交互计划](https://www.xianshe.com/plugin.php?id=hl_skillhub&mod=detail&slug=gemini-omni-2)