我是靠谱客的博主 儒雅花卷,最近开发中收集的这篇文章主要介绍Python爬虫快跑系列(二)async 爬取饿了么商家信息和对应的评论,并且利用snownpl进行评论情感分析,觉得挺不错的,现在分享给大家,希望可以做个参考。

概述

1.背景:

最近在学协程异步python异步,想借此机会练习一下,而且网上用协程爬虫的文章好像不也不多,所以借此机会实验一番。

2.站点分析:

爬取的是eleme的h5页面,难度比较小,电脑端的需要登陆,而且是手机号码接收验证码的登陆,不想要用cookie登陆,所以找个办法,借助h5页面去爬取。

3.需求:

需求如下图,字段很多,原谅我爬虫就喜欢爬尽所有字段,其实做爬虫分析目标的字段也是蛮有趣的,也挺累的。。。
在这里插入图片描述
爬取评论是因为想学习分词
在这里插入图片描述

4.github:

源码:Async_eleme,做的不好,仅供参考,如果对您有帮助,star一下,谢谢啦~

5.数据分析:

用snownpl对广州天河地区的小龙虾外卖进行用户的情感分析,越是接近0,就越趋向于负情绪,也可以理解为差评,接近1反之。分析结果如图:
在这里插入图片描述
可以看到,接近0的数目明显多于接近1的数目,可以大致推测出,该地区的小龙虾外卖评价不是很好。
分析的源码

6.更新:

最近写了一个梨视频app爬虫,源码:Async_pearvideo

最后

以上就是儒雅花卷为你收集整理的Python爬虫快跑系列(二)async 爬取饿了么商家信息和对应的评论,并且利用snownpl进行评论情感分析的全部内容,希望文章能够帮你解决Python爬虫快跑系列(二)async 爬取饿了么商家信息和对应的评论,并且利用snownpl进行评论情感分析所遇到的程序开发问题。

如果觉得靠谱客网站的内容还不错,欢迎将靠谱客网站推荐给程序员好友。

本图文内容来源于网友提供,作为学习参考使用,或来自网络收集整理,版权属于原作者所有。
点赞(36)

评论列表共有 0 条评论

立即
投稿
返回
顶部