python 中文查找_Python查找文件中包含中文的行方法

weixin_39758229

于 2020-12-06 12:14:50 发布

阅读量301

点赞数

文章标签： python 中文查找

前言

近几天在做多语言版本的时候再次发现，区分各种语言真的是一件比较困难的事情，上一次做中文提取工具的就花了不少时间，这次决定用python试一试，结果写起来发现真是方便不少，自己整理了一下方便以后查找使用。

代码

#!/usr/bin/env python3

# -*- coding: utf-8 -*-

# find the line of containing chinese in files

__author__ = 'AlbertS'

import re

def start_find_chinese():

find_count = 0;

with open('ko_untranslated.txt', 'wb') as outfile:

with open('source_ko.txt', 'rb') as infile:

while True:

content = infile.readline()

if re.match(r'(.*[\u4E00-\u9FA5]+)|([\u4E00-\u9FA5]+.*)', content.decode('utf-8')):

outfile.write(content)

find_count += 1;

if not content:

return find_count

# start to find

if __name__ == '__main__':

count = start_find_chinese()

print("find complete! count =", count)

原始文件

source_ko.txt文件内容

3 캐릭터 Lv.50 달성

8 캐릭터 Lv.80 달성

10 캐릭터 Lv.90 달성

...

...

2840 飞黄腾达

4841 同归于尽

8848 캐릭터 Lv.50 달

运行效果(ko_untranslated.txt文件)

2840 飞黄腾达

4841 同归于尽

总结

1. 其实这段小小的代码中包含了两个常用的功能，那就是读写文件和正则表达式。

2. 这也是两个重要的知识点，其中with操作可能防止资源泄漏，操作起来更加方便。

3. 正则表达式可是一个文字处理的利器，代码中的正则可能还不太完善，后续我会继续补充更新。

以上这篇Python查找文件中包含中文的行方法就是小编分享给大家的全部内容了，希望能给大家一个参考，也希望大家多多支持我们。

本文标题: Python查找文件中包含中文的行方法

本文地址: http://www.cppcns.com/jiaoben/python/247741.html

weixin_39758229

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。