Back to skills
extension
Category: Data & AnalyticsNo API key required

短视频后台数据读取与复盘助手(视频号+抖音)

打开有头浏览器(用户本人扫码登录)读取视频号助手(channels.weixin.qq.com)或抖音创作者中心(creator.douyin.com)后台的账号视频数据(播放/涨粉/完播率/跳出率/互动等),转写成结构化 Markdown 数据文档、附数据洞察总结与下一步行动建议,并存入用户指定文件夹。隐私边界明确:只读页面展示数据、只进数据页,不采集 Cookie/Token/网页源码等敏感信息,不采集他人个人信息,数据不上传第三方,用户随时可终止。依赖未安装时引导用户确认后自动安装。适用于短视频数据复盘、账号数据采集、周报月报数据源准备等场景。触发词:读后台数据、抓视频号数据、抓抖音数据、短视频数据采集、账号数据复盘、拉一下账号数据。

personAuthor: user_836f212chubcommunity

短视频后台数据采集(视频号 + 抖音)

用浏览器自动化读取用户本人短视频账号后台的真实数据,转写成 Markdown 文档。本技能只读不写:只浏览和读取,绝不点击任何"发布/编辑/删除/设置"类按钮。

名词解释(给用户看的大白话)

  • 有头浏览器:带界面、能亲眼看到操作过程的浏览器窗口。AI 在里面点页面、翻页时,用户全程看得见——区别于"无头模式"(在后台悄悄运行,屏幕上什么也看不到)。本技能强制使用有头模式,就是让用户能全程监督每一步操作,扫码登录也必须在这种模式下完成。
  • agent-browser CLI:让 AI 能"操作浏览器"的命令行工具(打开网页、点击、截图、读取页面内容都靠它)。本技能的底层依赖。

前置条件

  1. agent-browser CLI(浏览自动化的底层工具)
  2. 本机已安装 Google Chrome,并知道其路径:
    • Windows 默认:C:/Program Files/Google/Chrome/Application/chrome.exe
  3. 每条命令前导出环境变量(用系统 Chrome + 有头模式,用户需要在屏幕上看到操作过程并扫码):
export AGENT_BROWSER_EXECUTABLE_PATH="C:/Program Files/Google/Chrome/Application/chrome.exe"
export AGENT_BROWSER_HEADED=1

macOS/Linux 的 Chrome 路径按实际填写;若用户机器上装的是 Edge,路径换成 Edge 的可执行文件也可。

依赖检测与自动安装(第 1 步之前先做)

开始工作流程前,先检测 agent-browser 是否已安装:

agent-browser --version
  • 已安装(返回版本号)→ 直接继续
  • 未安装(命令不存在/报错)→ 不要静默失败,按此流程处理
    1. 明确告知用户:"本技能需要 agent-browser 工具(用于浏览器自动化),检测到尚未安装,约需 1-2 分钟。是否现在自动为你下载安装?"
    2. 必须等用户同意,不得擅自安装
    3. 用户同意后执行:npm i -g agent-browser
    4. 安装完成再次 agent-browser --version 验证成功,然后继续工作流程
    5. 用户拒绝则停止,告知用户可自行安装后重试
  • 同理检测 Chrome 路径是否存在(lstest -f);不存在时提示用户,并列出 Edge 等替代浏览器路径让用户确认

工作流程(八步,顺序执行)

第 1 步:用户授权确认(读取任何页面内容之前,必须做)

在打开浏览器、读取任何网页内容之前,以"弹窗式确认"的方式(对话中单条醒目消息)向用户明示本次操作将做什么、不做什么,并取得明确同意

"⚠️ 数据采集授权确认 接下来我将: ① 打开一个你能亲眼看见操作的浏览器窗口; ② 登录由你本人完成(手机扫码)——我不会、也不能替你输入账号密码或点击登录; ③ 我将只读采集该账号页面展示的视频数据指标(播放/涨粉/完播率等),不采集 Cookie、Token、账号密码、网页源码等任何敏感信息(页面结构仅用于即时定位数据,不保存不外传),绝不碰发布、编辑、删除类操作,不进入私信、收入、实名认证等敏感页面; ④ 数据仅在本对话内处理,转写成的数据表只保存到你指定的文件夹,不上传任何第三方; ⑤ 全程你随时可以喊停,我立即停止并关闭浏览器。 是否同意现在开始?"

规则:

  • 用户明确同意("好/可以/开始")→ 进入第 2 步
  • 用户未回应、犹豫或拒绝 → 停止,不打开浏览器,不采集任何数据
  • 本步骤适用于每一次执行,包括老用户再次使用——每次采集前都要确认,不做"上次同意过这次免问"
  • 目的:知情同意留痕(合规声明第 1 条的动作化)——用户授权的是"这次、这个账号、只读采集、登录我自己来"

第 2 步:确认参数

开始前与用户确认三项(用户未说清就问,不要猜):

  • 平台:视频号 / 抖音 / 两者都抓
  • 输出文件夹:文档写到哪里(绝对路径)
  • 范围:全部视频 / 最近 N 条 / 某时间之后

第 3 步:启动浏览器打开后台

agent-browser open "<后台首页 URL>" && agent-browser wait --load networkidle --timeout 20000 && agent-browser snapshot -i

后台入口:

  • 视频号助手https://channels.weixin.qq.com/platform/home
  • 抖音创作者中心https://creator.douyin.com/creator-micro/home

第 4 步:处理登录(关键交互点)

  • 已登录:快照中直接出现后台界面(账号名、粉丝数、菜单栏)→ 进入第 5 步
  • 未登录 / cookie 过期
    1. agent-browser screenshot 截取当前页面给用户看
    2. 明确告诉用户:"请用手机扫码登录,扫完告诉我"
    3. 轮询等待:agent-browser wait --time 8agent-browser snapshot,循环检查是否出现后台界面(最多等 3 分钟)
    4. 登录成功后继续

登录安全铁律

  • 登录一律由用户本人完成:本技能绝不代输账号/密码/验证码,绝不代点"登录"按钮;只负责打开登录页、截图提示、等待
  • 全程不记录、不保存、不传输任何账号、密码、cookie、token;截图时避免截到敏感信息
  • 会话结束后 agent-browser close 关闭浏览器

第 5 步:导航到数据页并抓取

两个平台的后台结构完全不同,必须分别按对应指南操作

  • 视频号助手:大量内容在 Shadow DOM 里,普通 querySelectorAll 抓不到——按 references/wxchannels-guide.md 的递归遍历方法抓取
  • 抖音创作者中心:普通 DOM,但数据卡片结构需要锚点切分——按 references/douyin-guide.md 的 label-value 配对方法抓取

通用要点:

  • 每进入一个新页面,先 agent-browser snapshot -i 看结构,再决定点哪里
  • 翻页/加载更多:点击"下一页/加载更多"后必须重新 snapshot,逐屏累积数据
  • 抓不到的字段如实标注,禁止脑补

第 6 步:转写文档

按以下模板生成 Markdown(数字全部来自页面快照原文):

# <平台>账号数据表(YYYY-MM-DD 采集)

## 账号总览
| 指标 | 数值 |
|---|---|
| 账号名 | (快照原文) |
| 粉丝数 | ... |
| 总播放 | ... |

## 单条视频数据
| # | 标题 | 发布日期 | 播放 | 点赞 | 评论 | 转发/推荐 | 涨粉 | 完播率 | 其他指标 |
|---|---|---|---|---|---|---|---|---|---|
| 1 | ... | ... | ... | ... | ... | ... | ... | ... | ... |

## 采集说明
- 采集时间 / 采集方式 / 缺失字段原因(如"后台未展示该指标")

文件命名:<平台>数据表-YYYY-MM-DD.md(日期用 date 命令取当天,不要自己算),写入用户指定文件夹。若目标文件夹已有同名文件,先追加日期后缀或询问用户。

第 7 步:数据解读与建议(写进文档,不止给表格)

数据表之后,在同一文档末尾追加一节基于真实数据的总结与建议——用户要的不只是数字,是"看出什么、下一步干什么":

谁来做这一步(重要说明) 本技能是一份给 AI 智能体执行的操作手册,不含独立代码。第 3-6 步的浏览器操作与数据抓取由智能体通过 agent-browser CLI 完成;第 7 步的数据解读同样由执行本技能的智能体(即大模型)直接完成——它基于自己在前几步抓取的真实数据做分析。

  • 无需额外调用外部大模型,无需配置任何模型 API 密钥,零额外成本
  • 技能使用者不需要为此做任何配置:只要是在能执行本技能的 AI 助手环境里跑,解读能力自动具备
  • 若在不支持 AI 智能体的纯脚本环境使用本技能(仅照搬抓取流程),则只能产出第 6 步的数据表,第 7 步无法自动完成,需人工自行分析
## 本期数据总结与建议

### 数据洞察(3-5 条,全部有数据支撑,禁止空泛套话)
- 例:表现最好的 3 条视频是……共同点是……(题材/时长/钩子类型)
- 例:平均完播率 X%,低于/高于平台常见水平,短板在……
- 例:涨粉集中来自哪几条视频,说明当前账号的"记忆点"是……
- 例:互动率(赞/评/转)与播放量的比例说明……

### 下一步建议(3-5 条,可执行、分优先级)
- 例:继续加拍"××题材"(数据已验证有效)
- 例:暂停"××题材"(连续 N 条低于账号均值)
- 例:×× 指标异常,优先排查××

解读铁律

  1. 每条洞察必须能对应到表里的具体数字,禁止"内容质量有待提升"这类无数据支撑的空话
  2. 建议要具体到"拍什么题材/改什么指标",不写"继续努力"式套话
  3. 若数据量太少(如视频不足 5 条)或某指标大面积缺失,如实说明"样本不足以支撑结论",只给有限观察,不硬凑
  4. 结论语气给判断但留余地——数据是参考,不是圣旨

第 8 步:核对交付

  1. 自查:表格行数是否与后台视频总数一致;关键数字抽查 2-3 条与快照原文比对
  2. 用 present_files 向用户展示生成的文档
  3. agent-browser close 关闭浏览器
  4. 告知用户哪些指标因后台未展示而缺失

硬性红线

  1. 只读不写:绝不点击发布、编辑、删除、回复、设置类按钮;只浏览和读取
  2. 禁止编造:所有数字必须能在页面快照中找到出处;没有的字段写"—(后台未展示)"
  3. 不碰凭据:不保存账号密码 cookie,截图时避免截到敏感信息仍留在屏幕上时外传
  4. 平台结构会变:若 snapshot 结果与指南描述不符(平台改版),先重新分析当前页面结构、适配后再继续,并在文档"采集说明"里注明平台结构已变化
  5. 只采本人数据:本技能用于采集用户自己拥有登录权限的账号数据;用户拿不到后台权限的账号,不适用本技能
  6. 随时可终止:任何时刻用户说"停/终止/别抓了/先停一下",立即停止一切页面操作并 agent-browser close 关闭浏览器,此后不再访问任何页面;已采集但尚未交付的数据如何处理(保留/删除)询问用户决定
  7. 风控即停,禁止重试绕过:平台弹出滑块验证、安全提示、"环境异常"等风控信号时——滑块可由用户手动通过后继续;若用户不在场或风控反复出现,停止本次采集并如实告知,绝不通过换 IP、改 UA、脚本重试等方式绕过

数据与隐私边界(对用户的明确承诺)

执行本技能的智能体必须严守以下边界,且应在第 1 步授权确认中向用户如实告知:

  1. 只读展示数据,不碰底层敏感信息:只读取页面展示出来的业务数据指标(播放数、涨粉数、完播率、视频标题、发布日期等);不采集、不记录、不保存网页源码、Cookie、Token、Session、本地存储、账号密码等任何敏感信息。 诚实说明:读取展示数据的技术过程必然经过页面结构(快照/元素定位),这是所有浏览器读取数据的唯一途径;本技能的边界是——页面结构仅用于即时定位展示数据,用完即弃,不保存、不记录、不外传结构本身,最终落盘的只有展示数据的数字与文字
  2. 敏感页面一律不进入:只访问数据中心/内容管理等视频数据页面;不进入、不截图私信、收入/钱包、实名认证、账号安全设置、粉丝列表(含他人个人信息)等敏感页面。误入立即退出并告知用户
  3. 不采集他人个人信息:数据表中只写本人账号的视频指标;评论者、粉丝、私信对象等第三方个人信息一律不采集、不转写
  4. 数据只在本对话上下文处理:采集到的原始数据仅在当前对话内用于生成数据表和分析,不上传任何第三方服务器,不用于任何其他用途
  5. 唯一落盘的是用户要的成果:保存到用户指定文件夹的,只有转写后的数据表文档本身;不产生任何副本、缓存或日志文件
  6. 登录永远由用户本人操作:本技能只打开登录页并等待,扫码、输密码、过验证码全部由用户完成(详见第 4 步登录安全铁律)
  7. 本机残留如实告知(本技能不主动清理用户环境,也不隐瞒):
    • 扫码登录产生的登录态(会话)保留在用户自己的浏览器中——这是登录的必然结果,本技能不带走、不复制;介意的话用户可自行在浏览器中退出登录
    • 过程截图保存在本机 agent-browser 临时目录中,仅存本机、不外传;需要彻底清理时告知用户截图目录位置,由用户决定是否删除
  8. 用户随时可终止:见硬性红线第 6 条——终止后不再访问浏览器,未交付数据的处置由用户决定

合规与免责声明

  1. 使用前提:使用者必须对目标账号拥有合法登录权限(本人账号或获得账号所有者明确授权)。工作流程第 1 步即为此设置的授权确认环节:每次采集前必须以弹窗式确认向用户明示操作内容与数据隐私边界(只读展示数据、不碰 Cookie/Token、数据不上传第三方、可随时终止),未经同意不得开始
  2. 平台条款:各平台用户协议对自动化访问的界定可能变化。本技能的工作方式是"真人扫码登录 + 有头浏览器人工监督 + 只读采集",不破解任何验证措施(验证码/滑块一律由用户手动完成,触发风控即停——见硬性红线第 7 条),不采集他人数据,不伪造流量
  3. 数据用途:采集结果仅供使用者本人进行内容复盘与运营分析,禁止将数据用于转售、公开传播或任何侵犯他人权益的用途
  4. 责任边界:使用者因违反平台条款或本声明造成的账号风险(如风控限制),由使用者自行承担;发现平台明确限制此类操作时应立即停止使用

常见故障

| 现象 | 处置 | |---|---| | cookie 过期需重新扫码 | 正常现象,走第 4 步扫码流程 | | 弹出滑块验证/安全提示 | 在场时由用户手动完成后继续;反复出现或用户不在场 → 停止本次采集,如实告知,禁止绕过(硬性红线第 7 条) | | 视频号快照内容大量缺失 | Shadow DOM 问题,见 wxchannels-guide.md | | 抖音数据页空白 | 先 wait --load networkidle 再 snapshot;仍空则说明该数据在 APP 端,如实告知 | | 点击无反应 | 先 snapshot 确认元素 ref 存在,换 ref 重试;仍失败告知用户手动点该步 |