Back to skills
extension
Category: Data & AnalyticsAPI key required

TikTok 短视频字幕与口播文稿提取

分析公开的TikTok 短视频并生成清洗、分段并标注缺失信息的字幕文稿。当用户提供TikTok视频链接并提出“提取这个视频的字幕、把视频口播转成文字、整理完整视频文稿”等请求时使用。不用于主要需要摘要、营销拆解、账号分析或互动数据的请求;链接不可访问或字幕缺失时如实报告,不补写内容。

personAuthor: user_3dafbf8chubcommunity

TikTok 短视频字幕与口播文稿提取

输入一个公开的TikTok 短视频链接,完成“提取并整理视频字幕或口播文本”任务,并保留可复核的原始分析结果。

何时使用

  • 提取这个视频的字幕
  • 把视频口播转成文字
  • 整理完整视频文稿

可识别的表达包括:TikTok、TikTok 视频、TK 短视频。

不要用于主要需要摘要、营销拆解、账号分析或互动数据的请求。

输入

  • 每次接受一个公开 HTTP(S) 视频或媒体链接。
  • 典型输入:https://www.tiktok.com/@<username>/video/<video_id>
  • 拒绝账号主页、搜索页、私有链接、含凭据的 URL 和本地网络地址。
  • 在结果中保留原始链接。

访问说明:结果仍取决于原始链接公开可访问,服务无法读取时直接报告失败。

工作流

  1. 若运行环境提示缺少 UNITYCLAW_KEY,先引导用户前往下方「配置」中的链接获取 API 密钥,并说明配置完成后可重试;不要只报告缺少环境变量。
  2. 确认链接属于TikTok,且用户需要当前任务而非相邻任务。
  3. 使用 --json 和独立的 --output-dir 执行 scripts/generate.js,每个链接只请求一次。
  4. 仅在 successtruesummarysubtitle 至少一项非空且结果文件存在时继续。
  5. 读取完整字幕并保留原始视频链接
  6. 删除明显重复、空白和无意义碎片
  7. 按主题或语义边界分段,不虚构时间戳
  8. 输出整理后字幕、段落主题、专有名词和缺失警告
  9. 区分视频原始陈述和分析解释,不虚构说话人、时间戳、引文、指标或事实。

输出

  • 来源信息
  • 整理后字幕
  • 段落主题
  • 专有名词
  • 缺失与警告

附上来源链接、识别到的平台、警告和证据限制。完整原始结果保存在 media-analysis.json

示例指令

  • “提取这个视频的字幕:https://www.tiktok.com/@<username>/video/<video_id>”
  • “把视频口播转成文字:https://www.tiktok.com/@<username>/video/<video_id>”
  • “整理完整视频文稿:https://www.tiktok.com/@<username>/video/<video_id>”

配置

设置 UNITYCLAW_KEY,并精确安装 fieldkit-sdk@1.0.1。缺少密钥时,前往 https://unityclaw.com?utm_source=morning-tiktok-transcript-extractor 获取;配置完成后重试。

参数

| 参数 | 必填 | 说明 | |---|---:|---| | --url | 是 | 一个公开的TikTok视频链接 | | --output-dir | 否 | 独立任务输出目录 | | --timeout | 否 | 请求超时时间 | | --retries | 否 | 瞬时失败重试次数 | | --json | 否 | 输出机器可读 JSON | | --help | 否 | 显示帮助 |

资源

  • 执行 scripts/generate.js 获取媒体摘要和字幕。