闲社服务运行正常AI智能体自动化平台
MiniMax H3音频字幕对齐工作流

MiniMax H3音频字幕对齐工作流

将 MiniMax H3 多镜头主音频、镜头时间线和字幕 cue 编译为可审阅报告与 SRT,提前发现空档、重叠和越界。

短视频图文内容
立即购买
技能数量
2
14,541
下载量
¥132.00
参考价 · 登录确认
10,710
销量

购买前,先确认这些

我的已购工作流

以下摘录自发布者现有说明,不代表平台已完成运行验证。完整交付范围、限制与验收要求请继续阅读原文。

交付内容

交付两个独立技能目录,包含 _meta.json、SKILL.md、agents/openai.yaml、README、脱敏 examples 和 Python 标准库脚本。 时间线示例应检查 3 个连续镜头并输出 pass;制造重叠或尾部空档应输出 block 和非零退出码。 字幕示例应输出 3 条合法 cue 和 SRT;制造重叠或越界 cue 应输出 block 和非零退出码。 不包含模型 API key、账号、上传、远程抓取、真实音频/视频、字幕翻译服务、额度或生成结果保证。

需要准备

脱敏的主音频定位符、项目总时长和镜头 start/end; 每镜头口播行、切点标记、字幕文本和语言; 目标模型入口、音频/字幕授权状态和人工验收要求。

运行与安装说明

运行时间线技能,校正镜头与主音频的边界。 将镜头结果或独立字幕 JSON 交给字幕技能,输出报告和 SRT。 在实际模型或后期软件中人工确认音频权利、口型、翻译和字幕可读性,再提交或导出。

费用、服务与边界

本套餐参考 MiniMax-AI 公开 H3 技能仓库对多镜头脚本、主音频连续性和精确时间映射的说明,参考公开 MiniMax 社区对音频时序控制的反馈,以及近期 ComfyUI 社区对 H3 批量分辨率/时长生成和计时 CSV 的公开讨论;来源只贡献需求与规则信号,脚本、字段、样例和两步组合为本轮原创实现。它不替代模型服务条款、版权/肖像判断或后期软件验证,不保证口型、音频、字幕、生成质量、速度或商业结果。

安装准备与故障排查确认材料、运行环境与额外费用后再购买。阅读完整说明

工作流详情

返回顶部