Scrapling 是一个自适应的 Python Web 爬取框架,支持从单次请求到全规模爬取。其解析器能自动适应网站变化并重定位元素,内置 Fetcher 可绕过 Cloudflare Turnstile 等反爬系统。
- 内置 Spider 框架:支持并发、多会话、暂停恢复、流式输出与机器人.txt 合规,可快速构建大规模爬虫
- 多种 Fetcher:HTTP/Stealthy/Dynamic 三类,分别用于高速请求、隐身绕过、完整浏览器自动化,均支持会话管理和代理轮换
- 集成 MCP 服务器:可与 Claude/Cursor 等 AI 工具配合,先提取目标内容再传给 AI,降低 token 消耗
- 性能领先:解析速度测试中,文本提取比 BS4+Lxml 快约 784 倍,元素相似度搜索比 AutoScraper 快约 5 倍
安装:Python 3.10+,
pip install scrapling,可选浏览器依赖 pip install "scrapling[all]",Docker 镜像已预装所有浏览器。GitHub
#GitHub #开源
📢 频道:@GitHubTrendingHub
