S
Scrapling
BSD-3-ClausePython🕷️ An adaptive Web Scraping framework that handles everything from a single request to a full-scale crawl!
★ 72kFork 7k更新于 2026-08-01
🕷️ An adaptive Web Scraping framework that handles everything from a single request to a full-scale crawl!
Scrapling 是一个自适应的 Web 抓取框架,能够处理从单次请求到全规模爬取的所有任务。其解析器能学习网站变化,在页面更新时自动重新定位元素;其抓取器可开箱即用地绕过 Cloudflare Turnstile 等反爬系统;其爬虫框架支持并发、多会话爬取,具备暂停/恢复和自动代理轮换功能。所有功能仅需几行 Python 代码即可实现。
docker pull pyd4vinci/scrapling
Scrapling 要求 Python 3.10 或更高版本。
运行 pip install "scrapling[all]" 安装所有依赖,然后运行 scrapling install 安装浏览器和系统依赖。
是的,StealthyFetcher 可以自动绕过 Cloudflare Turnstile 和 Interstitial 页面。
支持,所有抓取器都有对应的异步版本(如 AsyncFetcher、AsyncStealthySession),爬虫框架也基于异步。
在 Spider 中设置 crawldir 参数,运行后按 Ctrl+C 会优雅暂停,重新启动时传入相同目录即可恢复。