Firecrawl 网页采集
- 唯一标识:
hub-firecrawl-scraper - 显示名称:Firecrawl 网页采集
- 能力摘要:使用 Firecrawl API 对公开网页进行抓取、深度爬取、结构化提取、截图和 PDF 内容处理,并管理 API 密钥、范围、失败重试与结果质量。
案例素材
- 市场研究团队要汇总竞品官网的产品页与定价说明。该 skill 会限定起始域名和可抓取路径,执行深度爬取后提取标题、价格、功能和更新时间字段,并保留页面 URL 便于人工复核。
- 客服知识库包含大量 PDF 手册和动态网页。该 skill 会选择适合的抓取和提取方式,把文本、截图或文档内容转换为可检索资料,并为无法解析的页面记录失败原因和补采队列。
- 业务人员希望从供应商目录抓取联系人数据。该 skill 会要求先确认站点条款、访问权限和采集范围,最小化请求频率与字段量,安全保存 API 密钥,并避免把抓取能力用于绕过访问控制。
微信扫一扫