← Back to skills
extension
Category: Content & MediaAPI key requirement unconfirmed

OVAgent 电影分支制片人(AI PC 端云协作短片制作)

ovagent-film-producer 是面向 Intel AI PC(Agentic PC)的端云协作短片制作 Skill:在 WorkBuddy 中用一句自然语言发起,即可完成「剧情规划 → 云端视频生成 → 端侧视觉复核 → 本地配音 → 中英双语字幕 → 成片交付」的完整闭环。 工作流程: 1. WorkBuddy(Agent)读取用户剧情需求,结合参考首图撰写分镜计划(单段 4–15 秒、768P、英文动作提示词、1–2 句短台词),计划落盘并做 SHA-256 哈希冻结。 2. 用户显式授权后,Skill 仅提交一次付费生成请求(MiniMax 官方 H3 V2 接口,图生视频、首帧继承、AIGC 水印开启),随后只查询同一任务,绝不重复扣费重交。 3. 生成完成后自动抽取尾帧与 4x4 联络图(contact sheet),由 Agent 逐项复核动作线、角色一致性、道具与构图,撰写真实检查备注后才批准。 4. 端侧 CPU 运行 Qwen3-TTS-0.6B 为台词合成原创 AI 英文配音(Aiden/Ryan 音色,非演员声音克隆),按真实音频时长生成中英双语字幕并烧录,FFmpeg 合成交付 MP4。 工程亮点: - 状态机 + 文件锁 + 哈希保护:计划、种子图、已生成素材任何改动都会被拦截,杜绝“旧视频伪装新生成”。 - 花费可控:预算锁定单段 768P,429 限流/401 鉴权/402 余额等错误分类落盘凭证,失败不自动付费重试。 - Hybrid AI:Agent 规划与质检在端侧(Intel 酷睿 Ultra AI PC),重生成算力在云端,语音合成完全离线本地运行,敏感素材不出本机。 依赖:Intel AI PC(Windows)、C:\OVAgent 运行时、MiniMax 官方 API Key(经环境变量注入,包内不含任何凭据)。适用场景:假想剧情短片、AI 影视分镜验证、端侧 Agent 影音生产管线演示。

personAuthor: DracarysallhubModelScope

电影分支制作

这是制作入口,不使用 ovagent-film-demo 的旧视频作为新结果。所有执行都在 NucBox_EVO-T1 上,Python 为 C:\OVAgent\venv\Scripts\python.exe。 脚本是本技能目录 scripts/produce.py,以下用 PRODUCE 指代其绝对路径。 无需网页服务,不调用 YuanjingVL,不下载新模型。

规划

本次预算固定为一段15秒、MiniMax-H3官方V2、768P。禁止2K、第二段、额外试生成、Context-IR或再生成接口。 使用官方 MINIMAX_API_KEY,不是元景密钥。用户授权正式生成后只提交一次,后续仅查询同一任务。 15秒聚焦一个因果变化:忍住不打→摘下手套→握住手套、危机暂解。不要强塞跨地点的长期蝴蝶效应,正常动作速度,不靠慢放延长。 规划由 WorkBuddy 完成,不宣称其为本地 OpenVINO LLM 推理。 若用户提供语音,可先用现有 C:\OVAgent\tools\whatif_cli.py run --audio <wav> 取得本地规划参考;该旧CLI只规划,不能用来生成视频。 没有参考图时说明缺少角色外观条件;本次复联案例可用已有 C:\OVAgent\outputs\titan\assets\context-wide.png,先查看图像再写动作。 不从文字名称臆造未出现角色的精确外观。分段之间只继承前一段真实尾帧。

在 C:\OVAgent\outputs 下写 UTF-8 计划文件,结构如下:

{"title":"忍住这一拳","request":"用户原需求","planner":"WorkBuddy",
"seed_image":"C:/OVAgent/outputs/titan/assets/context-wide.png","ratio":"21:9",
"segments":[
 {"prompt":"English action at normal speed, no dialogue; natural end composition keeping next segment's needed features visible.","duration":15,
  "lines":[{"speaker":"Aiden","en":"I won't hit him.","zh":"我不会动手。","start":1},{"speaker":"Ryan","en":"Keep it safe.","zh":"保管好它。","start":10}]}
]}

提示词不要包含字幕;每段1–2句短台词,留足语音时长。只使用 Aiden/Ryan 原创AI音色。 把分镜与预计云端生成数量告诉用户。确认付费生成前只执行 init/status,不调用 advance。 用户已明确批准当前计划和生成费用时,不重复索要同一批准。

真实执行

  1. python PRODUCE init --plan <plan.json>:校验并快照计划,返回 project 路径。
  2. 获准后 python PRODUCE advance --project <project> --cloud-consent:最多提交当前段一次,保存ID后低频查询。每次最长约4分钟;若仍生成,重复同一命令仅查询,不重交。
  3. 返回 awaiting_review 时读取返回的 contact.png 和 tail.png,检查动作、角色、道具与下段衔接。使用可用视频查看工具检查完整片段;如果只能查看抽帧,明确记录这一限制,不宣称已观看全片。
  4. 可用时 python PRODUCE review --project <project> --notes-file <UTF8检查备注文件>。这是WorkBuddy视觉复核,不是用户人工审核或云端QA。明显缺失道具、变形或衔接错误时不批准,不自动循环重做;解释并等待修订决定。
  5. 所有段复核后 python PRODUCE finish --project <project>:本次重新合成英文配音,按实际音频长度生成字幕,合成新的完整视频;命令可能数分钟,等结束,不重复并发运行。
  6. 阅读输出receipt,打开最终MP4供用户试听、观看。技术解码通过不等于剧情与音色已经用户认可。

status 随时可用。submission_unknown 禁止重交,先查持久凭证。failed 不自动付费重试。 429 明确拒绝会返回 rate_limited,不是提交成功或结果未知。原样报告 http_status、api_code、api_message、diagnostic。 官方错误:401/1004鉴权,402/1008余额不足,429/1002限流,422/1026内容审核。保留原始信息及trace_id,不混同元景5001。共享21秒节流继续保留,单任务执行,不追求官方并发上限。 不要修改 state.json、直接调用接口或新建同需求项目绕过状态保护。旧项目 submission_unknown 必须先核实提交凭证,不能自行重置。 限流后停止当前生成尝试;用户明确要求重试时,等待 retry_not_before,再执行 advance 的 --cloud-consent --retry-rejected。 脚本最多容许一次显式限流重试;再次拒绝应提交诊断给平台,不持续试探。不用改模型、换密钥或关闭网关来绕过限流。 计划快照不能改;要改剧情另建计划并重新确认。禁止用已存在视频伪装本次生成。 云端生成、查询共享21秒请求间隔;不并行分段。英文配音在盒子CPU运行;原混合音轨在配音版中移除。 本包依赖已配置盒子运行时,doctor可检查;不包含凭据、模型或影视版权授权。 官方文档:https://platform.minimaxi.com/docs/api-reference/video-generation-v2-create 和 video-generation-v2-query。 新建项目执行,不能将元景旧任务ID拿到官方查询;原项目保留。图生视频ratio为adaptive,取首图比例。 回复优先给用户成片与剧情结果,再简短提供本次任务ID、执行阶段和限制,不让用户手工运行内部命令。