本文实例讲述了Python实现统计英文文章词频的方法。分享给大家供大家参考,具体如下:
应用介绍:
统计英文文章词频是很常见的需求,本文利用python实现。
思路分析:
1、把英文文章的每个单词放到列表里,并统计列表长度;
2、遍历列表,对每个单词出现的次数进行统计,并将结果存储在字典中;
3、利用步骤1中获得的列表长度,求出每个单词出现的频率,并将结果存储在频率字典中;
4、以字典键值对的“值”为标准,对字典进行排序,输出结果(也可利用切片输出频率最大或最小的特定几个,因为经过排序sorted()函数处理后,单词及其频率信息已经存储在元组中,所有元组再组成列表。)
代码实现:
fin = open("The_Magic_Skin _Honore_de_Balzac.txt") #the txt is up
#to you
lines=fin.readlines()
fin.close()
"""transform the article into word list
"""
def words_list():
chardigit="ABCDEFGHIJKLMNOPQRSTUVWXYZabcdefghijklmnopqrstuvwxyz0123456789 "
all_lines = ""
for line in lines:
one_line=""
for ch in line:
if c
最后
以上就是着急棉花糖最近收集整理的关于python英文词频统计-Python实现统计英文文章词频的方法分析的全部内容,更多相关python英文词频统计-Python实现统计英文文章词频内容请搜索靠谱客的其他文章。
本图文内容来源于网友提供,作为学习参考使用,或来自网络收集整理,版权属于原作者所有。
发表评论 取消回复