微信公众号文章提取器
把公开的微信公众号文章保存为本地 Markdown,并可按需下载图片或生成 HTML。
适用场景
- 用户给出公开的
mp.weixin.qq.com/s/...链接 - 需要保留标题、公众号、发布时间、正文、表格、图片
- 想把文章整理成本地可复用的 Markdown 或 HTML
快速使用
python scripts/extract_wechat.py "<ARTICLE_URL>" --out "<OUTPUT_DIR>" --json
常用参数:
--no-img:保留已批准的图片 URL,不下载图片--html:同时生成清理后的 HTML--overwrite:仅在用户明确同意覆盖时使用
输出约定
success:提取成功,返回 Markdown、可选 HTML 和图片信息partial:正文可用,但有警告,必须把警告告诉用户blocked:页面需要登录、验证或额外权限,不能绕过exists:已有输出未被修改,属于正常防覆盖结果error:按invalid_url、network_error或extraction_error解释原因
常见问题
- 为什么只支持公开文章?因为这个 skill 不绕过登录、付费墙或隐藏内容。
- 输出已存在怎么办?默认保留已有结果,覆盖前先确认用户明确同意。
- 图片没下全怎么办?正文仍然保留,结果里会说明哪些图片被跳过。
Scan to join WeChat group