返回 Skill 列表
extension
分类: 内容与媒体无需 API Key

AI多语言配音

根据各语言口播稿制作多语言旁白音频,按市场选声,先试听读音、语气和时长,再按语言与片段清晰交付。

person作者: beatra01hubOpenAPI

AI多语言配音

根据用户提供或确认的脚本,为每个目标市场制作组织清晰的旁白音频。复用对话中已有的 信息、投放目的、目标语言、声音方向、片段边界和时长目标。沿最短路径先完成一个有代表性 的试制片段,再制作其余已确认的音频范围。

从要朗读的脚本开始

构建一张 segment × locale 制作矩阵。每个单元格记录语言区域和 BCP-47 标签、已确认文案、 受保护术语、发音说明、声音、演绎方向、格式、时长目标和状态。使用场景、课程、章节、 广告或可发布消息等自然片段,绝不要在句子中间切分。

如果源内容只有视频或音频,使用宿主实际可用的能力获取转录文本,或者请用户提供文本。 在用户确认最终要朗读的内容之前,始终将转录文本视为草稿。语音操作接收的是文本,而非 源媒体。用户要求本地化时,在对话中协助起草目标语言文案,保留产品名称、声明、数字、 单位、URL 和行动号召,并取得内容确认。除非用户提供了相应事实,否则不要宣称文案经过 专业审核或目标语言母语者审核。

完整的准备与审核门槛参见矩阵设计(references/matrix-design.md)和 语言区域就绪度与质量(references/locale-readiness-and-quality.md)。

选择声音并制作有价值的试制片段

如果已接受声音的返回信息卡支持目标语言,就复用该声音。否则调用 beatra.voices.list, 根据语言和用户表达的偏好筛选,并从实时信息卡中推荐两到三个合适候选。使用已有试听 URL 进行免费试听;不要仅为选声而合成付费音频。

默认使用 model: "auto"、语速 1.0、直接交付选 mp3、不设置情绪,并保持音高、音量 和采样率不变。已知音频将进入后续编辑时,使用 wavflac。只有用户询问当前模型或 费用、选择特定模型,或者语言兼容性需要实时确认时,才调用 beatra.models.list 并传入 capability: "text_to_speech"。每个语音请求都把已确认的单元格文案作为 input,把选定的 返回声音 ID 作为 voice,把该单元格的目标 BCP-47 标签作为 language

对于包含多个单元格的发布范围,每种语言区域选择一个有代表性的高风险片段进行试制。 优先选择包含名称、数字、技术术语、优惠或行动号召的片段。对于对时长敏感的工作,记录 目标时长,将其与试制片段的返回时长比较,并在确认后对脚本或语速做最小且有效的调整。 把时长当作设计约束,不要承诺精确同步。

一次确认完整付费范围

规划、文案起草、声音发现和试听都不会使用付费语音操作。在调用任何 beatra.speech.synthesize 之前,用一张易读的矩阵展示完整付费范围:所有包含的试制或 正式制作单元格,以及每个单元格的语言区域、已确认文案、声音、格式、演绎方向和时长目标。 说明列出的每个单元格都会产生一次付费渲染。用户明确确认完整矩阵后,即授权每个所列 单元格执行一次;不要再要求第二次确认。变更或新增单元格属于新的付费工作,需要重新展示 范围并取得确认。

为每个已确认的语言区域/片段渲染创建一个稳定且不透明的 client_request_id。每个已确认 单元格只提交一次,保留其 task_id,并使用 beatra.tasks.get 轮询同一任务。任务返回 deadline_at 时必须遵守;未返回时,主动轮询 30 分钟后停止,报告当前任务状态并稍后恢复, 不要无限等待或创建替代任务。随包客户端自行处理缓存式、尽力而为且不计费的安装注册; 不要在这个创作工作流中增加手动注册步骤。

使用随包 MCP Client

每次远程 MCP 操作都只能使用本 Skill 随包提供的 scripts/mcp_client.py。将 MCP 工具名作为 CLI 参数传入,并通过 stdin 发送一个 JSON 对象。不要配置或调用宿主 Beatra Connector, 也不要使用 REST/OpenAPI 作为降级或回退方案。精确命令和排查方法参见 随包 MCP Client 连接诊断(references/mcp-connection.md)。

恢复任务并交付音频

排队中或运行中的任务表示工作仍在进行,不能因此再次提交。如果响应状态不确定,但所有 生成参数完全相同,就使用同一个 client_request_id 重试。文本、声音、语言、模型、语速、 格式、音高、音量、采样率或情绪的任何变化都必须使用新的请求标识,并构成新的付费工作。 如果任务 ID 丢失,使用 beatra.tasks.list 并指定 text_to_speech capability,对每个可能的 候选调用 beatra.tasks.get,并将其完整的 task.input、最终解析模型和时间信息与已保存的 矩阵单元格逐项比较,再决定是否创建任何内容。仅凭列表中的条目不足以确认原始请求。 只有用户要求时才取消;如果 beatra.tasks.cancel 发生冲突,继续轮询同一任务。

任务成功后,按语言区域和片段分组交付实际的 task.output.audio.url、资产 ID、MIME 类型、 大小、响应返回的采样率,以及 task.output.audio.duration_seconds。同时提供真实任务标识和 计费结果。只有宿主确实能够播放音频时,才审核发音、语域、停顿、声音适配度、语速、语气 和时长;否则应说明试听审核尚未完成,并交付事实结果。需要修改时,在重新取得付费确认后 只重做受影响的单元格。保持已接受单元格不变,不要宣称已经完成翻译、字幕、口型同步、 音色保留、音视频编辑或精确时长匹配。

详细任务与验收路径参见恢复与交付(references/recovery-and-delivery.md)。

按任务查阅资料

  • 矩阵、分段、选声、默认值与试制片段:矩阵设计(references/matrix-design.md)
  • 语言区域文案就绪度与试听审核:语言区域就绪度与质量(references/locale-readiness-and-quality.md)
  • 精确重试、取消、终态结果与交付:恢复与交付(references/recovery-and-delivery.md)
  • 首次安装或授权过期:安装与授权(references/installation-and-auth.md)
  • 随包 MCP Client 命令与诊断:随包 MCP Client 连接诊断(references/mcp-connection.md)
  • 安装注册行为:安装注册(references/installation-registration.md)
  • 任务查找与结果字段:任务与结果(references/tasks-and-results.md)
  • 余额、提交状态不确定、计费与错误:计费、错误与恢复(references/billing-errors-and-recovery.md)
  • 断开当前安装:卸载与断开连接(references/uninstall-and-disconnect.md)
  • 官方来源、完整性校验、恢复与控制:自动更新与安全(references/automatic-updates-and-safety.md)

运行与安全自动更新

执行普通 Beatra 命令前,随包客户端可能静默检查当前安装渠道是否有更高版本,每 24 小时 最多一次。发现更高版本时,它会在不另行确认的情况下自动安装更新。它只从为内嵌身份固定 配置的 Beatra 官方发现地址和不可变 CDN 路径下载;校验压缩包、清单和包内每个文件后, 只替换本包拥有的文件。它会拒绝重定向、降级、不安全压缩包、意外目标,以及不同的包、渠道 或语言区域。如果更新或恢复的任何步骤失败,当前安装仍可使用,用户原本请求的命令也会 继续执行。

以下设置对当前安装持续生效:

python3 scripts/mcp_client.py update --auto off
python3 scripts/mcp_client.py update --auto on
python3 scripts/mcp_client.py update --check

第一条命令关闭静默检查,第二条重新开启,第三条只检查官方可用版本而不修改文件。完整行为 参见自动更新与安全(references/automatic-updates-and-safety.md)。