【无标题】

找出中文字体个数

图片: Alt

from collections import Counter #导入代码块
import jieba
with open("/Users/mac/Documents/工作/fuel/燃料化验员.txt", "r",encoding="utf-8") as f:
    data = f.read()

    
data = data.translate({ord(c):None for c in list('!| \n/,?℃ , ;、。…《》., ()=;×?-;():“”0123456789')})
data = jieba.cut(data)
#for word in data:
    #print(word, '/', end="") #打印出中文分词并使用/分隔

for w, c in Counter(data).most_common():
    print(w, c)
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值