python按关键字筛选日志文件

        最近忙成了狗,五六个项目堆在一起,头疼的是测试还失惊无神的给我丢来一个几十甚至上百M的日志文件,动不动就几十上百万行,就算是搜索也看得头昏眼花的,因此自己花了点时间写了一段小脚本去过滤日志,当然这样的东西网上应该大把,但是还是想自己搞下,权当学习!

#!/usr/bin/python
# -*- encoding: utf-8 -*-
# version 1.0
import re
import time

'''
用于筛选日志文件,适用于python2.x版本
使用时将日志文件放于search.py工具同一目录
筛选完毕后会出现“旧文件名+当前时间”格式命名的新日志文件
'''


def getParameters():
    file_name = ""
    key_work = ""
    while (True):
        file_name = raw_input("请输入文件名:")
        key_work = raw_input("请输入过滤关键字:")
        if len(file_name) == 0 or len(key_work) == 0:
            flag = raw_input("您输入的文件名或关键子为空,输出c重试,q退出程序:")
            if flag == "q":
                return
            elif flag == "c":
                continue
        else:
            break

    new_file = file_name + "-" + formatTime(time.localtime())
    f = open("./" + file_name, "rb")
    lines = f.readlines()

    if len(lines) == 0:
        print("========日志文件为空========")
        f.close()
        return

    nf = open("./" + new_file, "wb");
    count = 0
    for line in lines:
        rs = re.search(key_work, line)
        if rs:
            print("[命中]--->%s" % line)
            nf.write(line)
            count = count + 1

    f.close()
    nf.close()
    print("共找到%d条信息" % count)


def formatTime(timevalue):
    '''
    format the time numbers
    '''
    return time.strftime("%Y%m%d%H%M%S", timevalue)


if __name__ == '__main__':
    getParameters()



说明:这段脚本我是直接在终端上./xxxx.py的方式运行的,我终端由于编译android源码需要装的是python2.7.6,在python3上运行估计会有问题。

好了,下面是我测试了下的赛选结果:

当然,这只针对单个文件而已!

  • 4
    点赞
  • 17
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值