Back to skills
extension
Category: Content & MediaNo API key required

AI首尾帧视频生成

用两张审核好的图片生成一条转场视频——从首帧到尾帧做变装、产品揭晓、前后对比、昼夜切换等丝滑转场。

personAuthor: beatra01hubOpenAPI

AI首尾帧视频生成

从一个确认的首帧到一个确认的尾帧,生成一条短的有方向的运动路径。本 Skill 适用于用户有两张端点图片,并要求首尾帧短片、双图转场、前后变身、变装转场、产品揭晓、昼夜切换、场景瞬移或循环式视觉回归。

适用范围与相邻路由

常规路线是两张确认图片和它们之间的一条转场片段。需要让单张起始图片动起来的请求路由到图生视频工作流;需要在一条源视频前后补画面的请求路由到视频续写工作流;需要转绘已有片段的请求路由到视频转绘工作流。本路线专注于两个严格图片端点之间的有方向转场。

输入与默认值

硬性输入是:

  • 两张具有清晰特征的确认端点图片(一个首帧和一个尾帧),宿主 Agent 可以查看;
  • 两帧之间应发生的事件。

只询问缺失的硬性输入。复用已知的场景、氛围、画幅和声音偏好。如果某个端点尚不存在,必须在生成视频之前作为单独的图片阶段创建并确认。

对于宿主 Agent 可访问的本地端点图片,仅在查看之后使用随包上传助手:

python3 scripts/mcp_client.py upload ./first-frame.png --mime-type image/png
python3 scripts/mcp_client.py upload ./last-frame.png --mime-type image/png

上传只是传输,不是创意审阅。保留返回的素材引用,绝不向远程工具传递本地路径。

默认输出一条转场片段和 model: "auto"。查看两端图片的人物特征、几何结构、构图、画幅、背景、光影以及视觉差异。将它们转化为转场映射:固定元素、变化元素、运动方向、镜头以及尾帧上的预定落点时刻。

黄金路径

  1. 查看两张端点图片。记录每张图片的实际 MIME 类型、宽度、高度、画幅和字节大小。识别人物特征、几何结构、构图、背景、光影、两帧之间的视觉差异以及所要求的两帧之间事件。

  2. 从两个端点构建转场映射:固定元素、变化元素、运动方向、镜头以及尾帧上的预定落点时刻。然后写出一条正向转场指令,命名运动应交付的单一事件。

  3. 如果某个端点需要创建,先通过 beatra.images.generate 作为单独的图片阶段制作并确认。读取图片卡的实时 pricing.options,用已准入画布匹配其维度;如果准入前无法确定唯一价格,就以符合条件的最高价格作为批准上限。绝不要按输入图片数量倍增图片估价。依赖尚未创建帧的转场在该帧存在且其真实 MIME 类型、字节和尺寸已通过下游验证之前无法提交。

  4. 调用 beatra.models.list 并传入 {"capability":"frames_to_video"},确认某张当前模型卡接受两张端点图片的实际 MIME 类型、尺寸和字节大小。确认实时的时长行为、画幅处理方式、该图片/音频组合是否允许驱动音频,以及计价基础。除非用户已选定一个具体的可用模型,否则保持模型为 auto

  5. 展示确切的首帧、尾帧、转场指令、使用驱动音频时的可选驱动音频、模型行为和付费边界。用一个不透明且稳定的 client_request_id 冻结它们;然后恰好调用一次 beatra.videos.interpolate,使用严格的 first_framelast_frame。只调用随包 scripts/mcp_client.py:MCP 工具名是 CLI 参数,其参数是标准输入上的 JSON。例如:

    printf '%s' '{"first_frame":{"type":"artifact","artifact_id":"art_first"},"last_frame":{"type":"artifact","artifact_id":"art_last"},"prompt":"Transform the subject from the daytime outfit to the evening outfit with a smooth camera push-in, keeping the face and background aligned.","client_request_id":"opaque-interpolate-id"}' | python3 scripts/mcp_client.py call beatra.videos.interpolate
    

    不要配置、调用或使用宿主 Beatra Connector。不要使用 REST/OpenAPI 回退。恰好提交一次 beatra.videos.interpolate

  6. 立即记录返回的任务 ID,并用 beatra.tasks.get 轮询同一任务直到终态。交付每一个返回的视频素材或链接。只报告实际返回的任务状态、解析后的模型、尺寸、时长、用量和 billing.net_charged_credits。审阅可访问的结果以确认确实从首帧开始、在尾帧结束,然后检查中间运动、人物和文字偏移、方向、时长和声音。说明宿主 Agent 能和不能查看的内容。

付费变更、恢复与取消

转场是一个付费视频阶段。更换首帧、尾帧、转场指令、驱动音频、模型或控制,都属于新的逻辑付费工作,配以新的 ID 和新的确认。单独创建的端点图片是其自身的付费图片阶段,拥有自己的请求 ID。

如果创建响应丢失,只用相同的阶段 ID 重放字节完全一致的冻结负载。如果任务 ID 丢失,调用 beatra.tasks.list 查找相关能力,用 beatra.tasks.get 检查可能的候选任务,并对照该阶段的私有账本确认后再考虑相同重试。排队和运行中是进度状态,不是失败。在规划变更工作之前先恢复原阶段;绝不重复付费提交,也不猜测其扣费或退款。

只有当用户要求取消时才调用 beatra.tasks.cancel。调用一次,并用 beatra.tasks.get 确认最终的终态。409 表示取消未确认,因此继续轮询同一任务,不要创建替代工作。

按任务查阅参考

  • 在构建转场映射、创建端点图片、核对实时模型事实、构造确切负载、轮询、恢复、取消或审阅端点保真度和中间运动时,阅读 首尾帧工作流(references/workflow.md)。
  • 仅当授权或共享凭据需要处理时,阅读 安装与授权(references/installation-and-auth.md)。
  • 关于非计费、尽力而为的安装登记步骤,阅读 安装登记(references/installation-registration.md)。
  • 关于共享的终态任务和素材语义,阅读 任务与结果(references/tasks-and-results.md);关于返回的计费或错误详情,阅读 计费、错误与恢复(references/billing-errors-and-recovery.md)。
  • 当随包客户端无法连接时,阅读 随包 MCP Client 连接诊断(references/mcp-connection.md)。不要配置宿主 Connector。
  • 关于更新保证和控制方式,阅读 自动更新与安全(references/automatic-updates-and-safety.md)。
  • 仅当用户要求移除本包或共享凭据时,阅读 卸载与断开连接(references/uninstall-and-disconnect.md)。

运行时与安全自动更新

每次 Beatra 操作都使用或调用随包 scripts/mcp_client.py。在每个安装中静默地每 24 小时最多检查一次更高版本。更高版本可用时,不另行确认而自动安装。它只从本包、渠道和语言对应的固定官方发现地址与不可变 CDN 路径下载,校验发现数据、压缩包、清单和每个打包文件,并且只替换本包文件。

更新检查、下载、校验、替换、回滚和恢复失败时,现有安装仍可使用,原本请求的命令继续执行。更新失败不会授权另一项付费请求。设置会在此安装中持续生效。

python3 scripts/mcp_client.py update --auto off
python3 scripts/mcp_client.py update --auto on
python3 scripts/mcp_client.py update --check

--auto off 禁用静默检查,--auto on 恢复静默检查,--check 报告官方可用版本而不替换文件。