我是靠谱客的博主 着急棉花糖,这篇文章主要介绍python英文词频统计-Python实现统计英文文章词频的方法分析,现在分享给大家,希望可以做个参考。

本文实例讲述了Python实现统计英文文章词频的方法。分享给大家供大家参考,具体如下:

应用介绍:

统计英文文章词频是很常见的需求,本文利用python实现。

思路分析:

1、把英文文章的每个单词放到列表里,并统计列表长度;

2、遍历列表,对每个单词出现的次数进行统计,并将结果存储在字典中;

3、利用步骤1中获得的列表长度,求出每个单词出现的频率,并将结果存储在频率字典中;

4、以字典键值对的“值”为标准,对字典进行排序,输出结果(也可利用切片输出频率最大或最小的特定几个,因为经过排序sorted()函数处理后,单词及其频率信息已经存储在元组中,所有元组再组成列表。)

代码实现:

fin = open("The_Magic_Skin _Honore_de_Balzac.txt") #the txt is up

#to you

lines=fin.readlines()

fin.close()

"""transform the article into word list

"""

def words_list():

chardigit="ABCDEFGHIJKLMNOPQRSTUVWXYZabcdefghijklmnopqrstuvwxyz0123456789 "

all_lines = ""

for line in lines:

one_line=""

for ch in line:

if c

最后

以上就是着急棉花糖最近收集整理的关于python英文词频统计-Python实现统计英文文章词频的方法分析的全部内容,更多相关python英文词频统计-Python实现统计英文文章词频内容请搜索靠谱客的其他文章。

本图文内容来源于网友提供,作为学习参考使用,或来自网络收集整理,版权属于原作者所有。
点赞(56)

评论列表共有 0 条评论

立即
投稿
返回
顶部