我是靠谱客的博主 儒雅花卷,这篇文章主要介绍Python爬虫快跑系列(二)async 爬取饿了么商家信息和对应的评论,并且利用snownpl进行评论情感分析,现在分享给大家,希望可以做个参考。

1.背景:

最近在学协程异步python异步,想借此机会练习一下,而且网上用协程爬虫的文章好像不也不多,所以借此机会实验一番。

2.站点分析:

爬取的是eleme的h5页面,难度比较小,电脑端的需要登陆,而且是手机号码接收验证码的登陆,不想要用cookie登陆,所以找个办法,借助h5页面去爬取。

3.需求:

需求如下图,字段很多,原谅我爬虫就喜欢爬尽所有字段,其实做爬虫分析目标的字段也是蛮有趣的,也挺累的。。。
在这里插入图片描述
爬取评论是因为想学习分词
在这里插入图片描述

4.github:

源码:Async_eleme,做的不好,仅供参考,如果对您有帮助,star一下,谢谢啦~

5.数据分析:

用snownpl对广州天河地区的小龙虾外卖进行用户的情感分析,越是接近0,就越趋向于负情绪,也可以理解为差评,接近1反之。分析结果如图:
在这里插入图片描述
可以看到,接近0的数目明显多于接近1的数目,可以大致推测出,该地区的小龙虾外卖评价不是很好。
分析的源码

6.更新:

最近写了一个梨视频app爬虫,源码:Async_pearvideo

最后

以上就是儒雅花卷最近收集整理的关于Python爬虫快跑系列(二)async 爬取饿了么商家信息和对应的评论,并且利用snownpl进行评论情感分析的全部内容,更多相关Python爬虫快跑系列(二)async内容请搜索靠谱客的其他文章。

本图文内容来源于网友提供,作为学习参考使用,或来自网络收集整理,版权属于原作者所有。
点赞(89)

评论列表共有 0 条评论

立即
投稿
返回
顶部