Back to skills
extension
Category: Data & AnalyticsNo API key required

微信公众号文章提取器

安全提取公开微信公众号文章为 Markdown,并可保存图片与 HTML。

personAuthor: user_e7edb73ahubcommunity

微信公众号文章提取器

把公开的微信公众号文章保存为本地 Markdown,并可按需下载图片或生成 HTML。

适用场景

  • 用户给出公开的 mp.weixin.qq.com/s/... 链接
  • 需要保留标题、公众号、发布时间、正文、表格、图片
  • 想把文章整理成本地可复用的 Markdown 或 HTML

快速使用

python scripts/extract_wechat.py "<ARTICLE_URL>" --out "<OUTPUT_DIR>" --json

常用参数:

  • --no-img:保留已批准的图片 URL,不下载图片
  • --html:同时生成清理后的 HTML
  • --overwrite:仅在用户明确同意覆盖时使用

输出约定

  • success:提取成功,返回 Markdown、可选 HTML 和图片信息
  • partial:正文可用,但有警告,必须把警告告诉用户
  • blocked:页面需要登录、验证或额外权限,不能绕过
  • exists:已有输出未被修改,属于正常防覆盖结果
  • error:按 invalid_urlnetwork_errorextraction_error 解释原因

常见问题

  • 为什么只支持公开文章?因为这个 skill 不绕过登录、付费墙或隐藏内容。
  • 输出已存在怎么办?默认保留已有结果,覆盖前先确认用户明确同意。
  • 图片没下全怎么办?正文仍然保留,结果里会说明哪些图片被跳过。