scrapy-redis简单配置详解

注意:

该篇文章为转载内容,此处只是为了巩固一下scrapy-redis的注意事项,scrapy-redis 现已在公司项目中稳稳当当的运行了,

可以查看该篇文章:

http://xudailong.gitee.io/2018/01/09/python_crawl_words/


由于Scrapy_redis已经为封装了大部分的流程,所以使用它不会有任何难度。

1.启动Redis

首先需要把Redis启动起来。使用Mac OS/Linux的同学在终端下面输入以下命令并回车:

redis-server

使用Windows的同学,在CMD中cd进入存放Redis的文件夹,并运行:

redis-server.exe
2.修改爬虫

在前面的课程中,我们爬虫是继承自scrapy.Spider这个父类。这是Scrapy里面最基本的一个爬虫类,只能实现基本的爬虫功能。现在需要把它替换掉,从而实现更高级的功能。

请对比一下下面这段使用了Scrapy_redis的代码与前面read color网站爬虫的代码头部有什么不同:

from scrapy_redis.spiders 
import RedisSpider
class ReadColorSpider(RedisSpider):    
    name = "readcolorspider"    
    redis_key = 'rea
评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值