科学使用scrapy shell

scrapy shell 的科学使用

scrapy shell 是在scrapy网络爬虫开发时非常有用的测试工具

在命令行里输入

>scrapy  shell url

就可以获得这个网页返回的response进行以下操作
在这里插入图片描述

这样对于一些对爬虫没有限制的网站是可行的,但是对于一些网站来说是会被制裁的,比如说豆瓣网
在这里插入图片描述
这个时候我们就需要在这个里面添加headers
这个时候我们需要这样提交url

scrapy shell  -s USER_AGENT='Mozilla/5.0' http://www.douban.com

在这里插入图片描述
这样就可以完成模拟headers的目的了

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值