802-Scrapy

功能:功能强大的网络爬虫框架,支持大规模数据爬取、数据提取、异步请求等。

PyPIhttps://pypi.org/project/Scrapy/

GitHubhttps://github.com/scrapy/scrapy

推荐使用:强烈推荐,大型爬虫项目必备。

案例(简单示例,实际需创建 Scrapy 项目):

1
2
3
4
5
6
7
import scrapy

class ExampleSpider(scrapy.Spider):
    name = 'example'
    start_urls = ['https://example.com']
    def parse(self, response):
        yield {'title': response.css('title::text').get()}