Scrapy 资源
后端网页提取的生产级生态系统
实用插件
scrapy-playwright
浏览器渲染
用于处理 JavaScript 站点和动态内容的现代标准,并遵循常规的 Scrapy 工作流程。
spidermon
监控
一个为 Scrapy 爬虫添加监控、验证和告警(Slack/Discord/电子邮件)功能的框架。
scrapy-zyte-api
反封锁
连接到 Zyte 的托管 API,实现自动代理轮换、浏览器指纹识别和防封锁。
scrapy-poet
页面对象 (Page objects)
将提取逻辑与爬虫中的解析逻辑分离。另请参阅 网页抓取副驾驶 (VS Code 插件) 以进行代码生成。