将 MiniMax H3 多镜头主音频、镜头时间线和字幕 cue 编译为可审阅报告与 SRT,提前发现空档、重叠和越界。
以下摘录自发布者现有说明,不代表平台已完成运行验证。完整交付范围、限制与验收要求请继续阅读原文。
交付两个独立技能目录,包含 _meta.json、SKILL.md、agents/openai.yaml、README、脱敏 examples 和 Python 标准库脚本。 时间线示例应检查 3 个连续镜头并输出 pass;制造重叠或尾部空档应输出 block 和非零退出码。 字幕示例应输出 3 条合法 cue 和 SRT;制造重叠或越界 cue 应输出 block 和非零退出码。 不包含模型 API key、账号、上传、远程抓取、真实音频/视频、字幕翻译服务、额度或生成结果保证。
脱敏的主音频定位符、项目总时长和镜头 start/end; 每镜头口播行、切点标记、字幕文本和语言; 目标模型入口、音频/字幕授权状态和人工验收要求。
运行时间线技能,校正镜头与主音频的边界。 将镜头结果或独立字幕 JSON 交给字幕技能,输出报告和 SRT。 在实际模型或后期软件中人工确认音频权利、口型、翻译和字幕可读性,再提交或导出。
本套餐参考 MiniMax-AI 公开 H3 技能仓库对多镜头脚本、主音频连续性和精确时间映射的说明,参考公开 MiniMax 社区对音频时序控制的反馈,以及近期 ComfyUI 社区对 H3 批量分辨率/时长生成和计时 CSV 的公开讨论;来源只贡献需求与规则信号,脚本、字段、样例和两步组合为本轮原创实现。它不替代模型服务条款、版权/肖像判断或后期软件验证,不保证口型、音频、字幕、生成质量、速度或商业结果。
以下为套餐组成,实际执行顺序请按上方工作流说明。安装所需环境、账号与外部服务费用请在购买前确认。