TikTok 短视频字幕与口播文稿提取
输入一个公开的TikTok 短视频链接,完成“提取并整理视频字幕或口播文本”任务,并保留可复核的原始分析结果。
何时使用
- 提取这个视频的字幕
- 把视频口播转成文字
- 整理完整视频文稿
可识别的表达包括:TikTok、TikTok 视频、TK 短视频。
不要用于主要需要摘要、营销拆解、账号分析或互动数据的请求。
输入
- 每次接受一个公开 HTTP(S) 视频或媒体链接。
- 典型输入:
https://www.tiktok.com/@<username>/video/<video_id> - 拒绝账号主页、搜索页、私有链接、含凭据的 URL 和本地网络地址。
- 在结果中保留原始链接。
访问说明:结果仍取决于原始链接公开可访问,服务无法读取时直接报告失败。
工作流
- 若运行环境提示缺少
UNITYCLAW_KEY,先引导用户前往下方「配置」中的链接获取 API 密钥,并说明配置完成后可重试;不要只报告缺少环境变量。 - 确认链接属于TikTok,且用户需要当前任务而非相邻任务。
- 使用
--json和独立的--output-dir执行scripts/generate.js,每个链接只请求一次。 - 仅在
success为true、summary或subtitle至少一项非空且结果文件存在时继续。 - 读取完整字幕并保留原始视频链接
- 删除明显重复、空白和无意义碎片
- 按主题或语义边界分段,不虚构时间戳
- 输出整理后字幕、段落主题、专有名词和缺失警告
- 区分视频原始陈述和分析解释,不虚构说话人、时间戳、引文、指标或事实。
输出
- 来源信息
- 整理后字幕
- 段落主题
- 专有名词
- 缺失与警告
附上来源链接、识别到的平台、警告和证据限制。完整原始结果保存在 media-analysis.json。
示例指令
- “提取这个视频的字幕:https://www.tiktok.com/@<username>/video/<video_id>”
- “把视频口播转成文字:https://www.tiktok.com/@<username>/video/<video_id>”
- “整理完整视频文稿:https://www.tiktok.com/@<username>/video/<video_id>”
配置
设置 UNITYCLAW_KEY,并精确安装 fieldkit-sdk@1.0.1。缺少密钥时,前往 https://unityclaw.com?utm_source=morning-tiktok-transcript-extractor 获取;配置完成后重试。
参数
| 参数 | 必填 | 说明 |
|---|---:|---|
| --url | 是 | 一个公开的TikTok视频链接 |
| --output-dir | 否 | 独立任务输出目录 |
| --timeout | 否 | 请求超时时间 |
| --retries | 否 | 瞬时失败重试次数 |
| --json | 否 | 输出机器可读 JSON |
| --help | 否 | 显示帮助 |
资源
- 执行
scripts/generate.js获取媒体摘要和字幕。
Scan to join WeChat group