Python爬虫快跑系列(二)async 爬取饿了么商家信息和对应的评论,并且利用snownpl进行评论情感分析

1.背景:

最近在学协程异步python异步,想借此机会练习一下,而且网上用协程爬虫的文章好像不也不多,所以借此机会实验一番。

2.站点分析:

爬取的是eleme的h5页面,难度比较小,电脑端的需要登陆,而且是手机号码接收验证码的登陆,不想要用cookie登陆,所以找个办法,借助h5页面去爬取。

3.需求:

需求如下图,字段很多,原谅我爬虫就喜欢爬尽所有字段,其实做爬虫分析目标的字段也是蛮有趣的,也挺累的。。。
在这里插入图片描述
爬取评论是因为想学习分词
在这里插入图片描述

4.github:

源码:Async_eleme,做的不好,仅供参考,如果对您有帮助,star一下,谢谢啦~

5.数据分析:

用snownpl对广州天河地区的小龙虾外卖进行用户的情感分析,越是接近0,就越趋向于负情绪,也可以理解为差评,接近1反之。分析结果如图:
在这里插入图片描述
可以看到,接近0的数目明显多于接近1的数目,可以大致推测出,该地区的小龙虾外卖评价不是很好。
分析的源码

6.更新:

最近写了一个梨视频app爬虫,源码:Async_pearvideo

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值