我是靠谱客的博主 儒雅花卷,最近开发中收集的这篇文章主要介绍Python爬虫快跑系列(二)async 爬取饿了么商家信息和对应的评论,并且利用snownpl进行评论情感分析,觉得挺不错的,现在分享给大家,希望可以做个参考。
概述
1.背景:
最近在学协程异步python异步,想借此机会练习一下,而且网上用协程爬虫的文章好像不也不多,所以借此机会实验一番。
2.站点分析:
爬取的是eleme的h5页面,难度比较小,电脑端的需要登陆,而且是手机号码接收验证码的登陆,不想要用cookie登陆,所以找个办法,借助h5页面去爬取。
3.需求:
需求如下图,字段很多,原谅我爬虫就喜欢爬尽所有字段,其实做爬虫分析目标的字段也是蛮有趣的,也挺累的。。。
爬取评论是因为想学习分词
4.github:
源码:Async_eleme,做的不好,仅供参考,如果对您有帮助,star一下,谢谢啦~
5.数据分析:
用snownpl对广州天河地区的小龙虾外卖进行用户的情感分析,越是接近0,就越趋向于负情绪,也可以理解为差评,接近1反之。分析结果如图:
可以看到,接近0的数目明显多于接近1的数目,可以大致推测出,该地区的小龙虾外卖评价不是很好。
分析的源码
6.更新:
最近写了一个梨视频app爬虫,源码:Async_pearvideo
最后
以上就是儒雅花卷为你收集整理的Python爬虫快跑系列(二)async 爬取饿了么商家信息和对应的评论,并且利用snownpl进行评论情感分析的全部内容,希望文章能够帮你解决Python爬虫快跑系列(二)async 爬取饿了么商家信息和对应的评论,并且利用snownpl进行评论情感分析所遇到的程序开发问题。
如果觉得靠谱客网站的内容还不错,欢迎将靠谱客网站推荐给程序员好友。
本图文内容来源于网友提供,作为学习参考使用,或来自网络收集整理,版权属于原作者所有。
发表评论 取消回复