scrapy如何使用,scrapy使用详解?

用户投稿 148 0

关于scrapy怎么处理自然语言的问题,小编就整理了2个相关介绍scrapy怎么处理自然语言的解答,让我们一起看看吧。

scrapy使用详解?

Scrapy使用详解

Scrapy Engine(引擎):负责Spider、ItemPipeline、Downloader、Scheduler中间的通讯,信号、数据传递等。

Scheduler(调度器):它负责接受引擎发送过来的Request请求,并按照一定的方式进行整理排列,入队,当引擎需要时,交还给引擎。

Downloader(下载器):负责下载Scrapy Engine(引擎)发送的所有Requests请求,并将其获取到的Responses交还给Scrapy Engine(引擎),由引擎交给Spider来处理。

Spider(爬虫):它负责处理所有Responses,从中分析提取数据,获取Item字段需要的数据,并将需要跟进的URL提交给引擎,再次进入Scheduler(调度器)。

Item Pipeline(管道):它负责处理Spider中获取到的Item,并进行进行后期处理(详细分析、过滤、存储等)的地方。

Downloader Middlewares(下载中间件):一个可以自定义扩展下载功能的组件。

Spider Middlewares(Spider中间件):一个可以自定扩展和操作引擎和Spider中间通信的功能组件。

scrapy和python有什么关系?

python是一门计算机语言,scrapy是用python语言编写的爬虫框架。

python可以理解成是基础零件,而scrapy是一个可以从网上爬数据的生产机器,机器也是由基础零件组成的,而机器由更加强大而专业的功能。

到此,以上就是小编对于scrapy怎么处理自然语言的问题就介绍到这了,希望介绍scrapy怎么处理自然语言的2点解答对大家有用。

抱歉,评论功能暂时关闭!