|
# Gemini Omni多轮视频编辑门禁工作流
## 套餐描述
先规划 Gemini Omni 1.1 Flash 的多模态交互请求,再按多轮编辑的保留项、修改项和人工审片结果决定是否进入交付候选。
## 详细介绍
# Gemini Omni多轮视频编辑门禁工作流
**2个实用技能 · 2步完成 · 每一步都能单独使用**
这套工作流面向 Gemini Omni 1.1 Flash 的视频生成、编辑、延展和首尾帧插值:第一步把文本、图片、音频、视频输入及任务意图整理成 Interactions API 前的离线计划;第二步把多轮交互成功与保留项、修改项、音画观察、人工审片和权属复核拆开验收。它不调用 Google API、不上传或读取媒体、不保存账号信息,也不把“返回视频”误报为“可以交付”。
2个可下载技能 · 每个技能可单独运行
## 2步自动化工作流
### 🔵 1 Gemini Omni 多模态交互计划
技能文件:`gemini-omni-interaction-plan`
**解决什么:** Gemini Omni 的生成、编辑、延展和插值使用不同输入关系;未固定媒体角色、视频时长、输出规格和保留/修改边界,容易把错误请求送入远程额度。
**你会得到:** `omni_plan_gate.json` 和 Markdown 报告,明确模型 ID、任务意图、输入角色、输出时长/分辨率/帧率、多轮关系、保留项和修改项。
**↓ 本步结果自动进入下一步**
### 🟢 2 Gemini Omni 多轮结果验收门禁
技能文件:`gemini-omni-conversational-result-gate`
**解决什么:** 自然语言连续编辑即使状态成功,仍可能改变原本要求保留的内容,或出现音画、对白、角色和画面问题。
**你会得到:** `omni_result_gate.json` 和 Markdown 报告,逐项记录父交互、保留项、修改项、音频/对白、人工审片和权属结论。
**↓ 本步结果形成最终交付**
## 实际示例
示例使用一条 8 秒脱敏视频、一张参考图和一段文字,要求只将背景改成清晨海边并保留人物动作、面部和镜头节奏。第一步生成交互计划;操作者在自己的 Google 环境完成一轮或多轮编辑后,第二步记录父交互关系、接口状态、保留项、修改项和人工观察。示例只演示字段与阻断逻辑,不代表已调用 Gemini Omni、输出质量达标、额度未消耗或素材具有商业授权。
## 适合谁
适合使用 Gemini Omni 1.1 Flash 做文本生视频、图生视频、视频编辑、视频延展、首尾帧插值和多轮自然语言修订的独立创作者、广告制作团队、短视频工作室、API 集成开发者和审片人员。
## 买家只需提供
- 已获授权或原创的文本、图片、音频、视频及相对路径记录
- 任务意图、目标时长/分辨率/帧率、多轮父交互关系和希望保留/修改的清单
- 远程结果状态、输出路径、逐项观察、人工审片和版权/肖像/隐私确认
## 使用方式
1. 将脱敏 JSON 放入两个技能的 `examples` 或自己的工作目录,先运行交互计划技能。
2. 在自己的 Google AI Studio、Gemini API 或兼容环境完成账号、额度、媒体上传和交互调用,再运行结果验收技能。
3. 只有人工审片、权属复核和费用确认均完成后,才将结果送入自己的剪辑或交付流程。
## 交付与验收
- 两个独立技能目录,含 `_meta.json`、`SKILL.md`、`agents/openai.yaml`、README、脱敏样例和可运行 Python 脚本。
- 第一技能正例输出 `ready_for_interaction_review`,第二技能正例输出 `ready_for_human_delivery_review`;缺任务输入、规格、父交互、保留/修改结论、音画观察、人工审片或权属说明时返回非零并阻断。
- 脚本只读 JSON,不联网、不读取/解码视频、不上传、不下载、不启动远程任务、不读取账号凭据;报告明确媒体未检查和网络未调用。
- 不包含 Google 账号、API 密钥、生成额度、远程上传、模型权重、成片下载、自动画质评分或持续调参服务。
## 服务说明
本产品依赖买家自己的 Gemini Omni 账户、API 权限、额度、素材、模型可用性和人工审片。模型 ID、视频输入限制、输出规格、交互字段、存储、计费和安全策略以买家当前官方文档与账户返回为准;本地门禁不证明远程请求一定成功。脚本不保证角色一致、动作保留、背景修改、音画同步、对白准确、画面真实、输出可商用或无需人工复核。涉及第三方 API、个人素材、版权、肖像、隐私、付款和发布时,买家必须先完成授权、最小权限、费用确认和不可逆操作确认。
## 公开来源与原创边界
公开来源只贡献 Gemini Omni 1.1 Flash 的模型 ID、文本/图片/音频/视频多模态输入、3–10 秒输出、视频编辑/延展/插值、多轮交互和公开采用/失败风险信号;Google 官方文档、Google Workspace 页面、GitHub 示例技能和公开社区没有提供本套餐代码。 本轮原创实现为两个 Python 离线校验器、四类任务意图与媒体角色契约、视频时长/规格门禁、保留项与修改项拆分、多轮父交互字段、音频/对白人工结论、权属门禁、JSON/Markdown 报告和两步组合,未复制来源代码、工作流文件、付费模板或私有流程。
## 套餐图标
<img id="aimg_Lkf4Z" onclick="zoom(this, this.src, 0, 0, 0)" class="zoom" src="https://www.xianshe.com/data/attachment/hl_skillhub/images/bundle_icon_1_1788083571.png" onmouseover="img_onmouseoverfunc(this)" lazyloadthumb="1" border="0" alt="" />
## 包含技能
- [Gemini Omni 多轮结果验收门禁](https://www.xianshe.com/plugin.php?id=hl_skillhub&mod=detail&slug=gemini-omni)
- [Gemini Omni 多模态交互计划](https://www.xianshe.com/plugin.php?id=hl_skillhub&mod=detail&slug=gemini-omni-2)
## 安装方式
此套餐为**付费套餐**,购买后可一键下载全部技能。
🛒 [点击购买并下载 Gemini Omni多轮视频编辑门禁工作流](https://www.xianshe.com/plugin.php?id=hl_skillhub&mod=buy&bundle_id=949)
## 收费方式
💴 **现金购买** - 需要支付 ¥137.00
## 前往安装
**[👉 点击前往套餐安装页面](https://www.xianshe.com/plugin.php?id=hl_skillhub&mod=bundle&ac=detail&slug=gemini-omni-interaction-plan-efc4280da2ad)**
|