Crawl4AI LLM 友好的网页爬虫
使用 Crawl4AI 运行网页爬取和数据抓取工作流,Crawl4AI 是一个开源爬虫,旨在生成 LLM 就绪的 markdown 和结构化提取输出。它支持异步爬取、浏览器自动化钩子、深度爬取、CLI 使用以及基于 Python 的数据管道。
安装
使用与您的环境匹配的上游安装或设置路径:
- pip install -U crawl4ai
- pip install crawl4ai --pre
- Crawl4AI 提供灵活的安装选项以适应各种使用场景。您可以将其作为 Python 包安装,或使用 Docker。
- pip install crawl4ai
来自上游的要求和注意事项:
- ✨ 之前的 v0.7.8:稳定性与错误修复发布!11 个错误修复解决了 Docker API 问题、LLM 提取改进、URL 处理修复和依赖更新。[发布说明 →](https://github.com/1991513ccie-png/skills
- 可部署到任何地方,无需密钥,支持 CLI 和 Docker,云友好
基本用法或入门笔记:
-
我将其开源是为了可用性,任何人都可以在没有门槛的情况下使用它。现在我正在构建平台以实现可负担性,任何人都可以运行严肃的爬取任务而不会超出预算。如果这引起了您的共鸣,请加入我们,s...
-
🚀 快速开始
-
用于预发布版本
-
Source: https://github.com/1991513ccie-png/skills
-
Extracted from upstream docs: https://raw.githubusercontent.com/unclecode/crawl4ai/HEAD/README.md
微信扫一扫