用Python的字典dict和列表list实现简单的单词词频统计

利用字典dict和列表list进行词频统计

简单的词频统计Python小程序

直接上代码

#词频统计
#在lyrics存入需要进行词频统计的字符串
lyrics = 'Dashing thro the snow, in a one-horse open sleigh.Over the fields we go, laughing all the way.\
Bells on bob-tails ring, making spirits bright,What fun it is to ride and sing a sleighing song tonight.\
Jingle bells, jingle bells, jingle all the way. Oh what fun it is to ride in a one horse open sleigh.\
Jingle bells, jingle bells, jingle all the way. Oh what fun it is to ride in a one horse open sleigh.'

strs = [',','.','!','?','~','\\','\r',' ']#存储出现的字符,可以根据需要添加
str1 = ' '

for i in strs:#删除标点符号
    lyrics = lyrics.replace(i,str1)#用空格替换标点符号

lyrics_list = lyrics.split(str1)#使用空格作为分隔,将字符串拆分转化为列表

dict1={}#创建空字典
sum1 = 1
for key in lyrics_list:#动态向字典添加元素
    word = key
    # 判断单词是否已存在
    if key in dict1:#若存在,value+1并修改字典
        i = dict1.get(word)
        i +=1
        dict1[word] = i
    else:#若不存在,便存入基础值1
        dict1.update({word:sum1})

#检查成果
z = 0
for i in dict1:
    s = dict1.get(i)
    z +=s

print(dict1)#打印最终的字典
print('lyrics_list共计',len(lyrics_list),'单词')#统计原始列表存入的单词总数
print('dict1共计',z,'单词')#统计字典的单词总数,观察是否与列表总数一致

需要的话用input实现动态输入字符串

  • 1
    点赞
  • 10
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
要使用Python实现文文本的词频统计,可以按照以下步骤进行: 1. 导入必要的库,包括`jieba`用于文分词。 2. 定义一个函数,命名为`word_frequency`,该函数接受一个文文本字符串作为参数。 3. 在函数内部,使用`jieba`库对文本进行分词,得到词语列表。 4. 初始化一个空字典`freq_dict`用于存储词频统计结果。 5. 遍历词语列表,对每个词语进行统计: - 如果词语已经在`freq_dict`,将其计数加1; - 如果词语不在`freq_dict`,将其添加到`freq_dict`并设置计数为1。 6. 返回词频统计结果`freq_dict`。 以下是用Python实现文文本词频统计的代码示例: ```python import jieba def word_frequency(text): word_list = jieba.lcut(text) # 文分词 freq_dict = {} for word in word_list: if word in freq_dict: freq_dict[word] += 1 else: freq_dict[word] = 1 return freq_dict ``` 你可以调用`word_frequency`函数并传入一个文文本字符串来进行测试,例如: ```python text = "今天天气真好,出去玩了一天。明天继续努力学习!" freq_result = word_frequency(text) print(freq_result) ``` 输出结果将为: ``` {'今天': 1, '天气': 1, '真好': 1, ',': 1, '出去': 1, '玩': 1, '了': 1, '一天': 1, '。': 1, '明天': 1, '继续': 1, '努力': 1, '学习': 1, '!': 1} ``` 这样就完成了使用Python实现文文本词频统计的过程。请注意,在进行文分词时,你可能需要提前安装`jieba`库,并且需要下载`jieba`的文分词词库。

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值