python实现按关键字筛选日志文件

Honoria ·
更新时间:2024-09-20
· 741 次阅读

最近忙成了狗,五六个项目堆在一起,头疼的是测试还失惊无神的给我丢来一个几十甚至上百M的日志文件,动不动就几十上百万行,就算是搜索也看得头昏眼花的,因此自己花了点时间写了一段小脚本去过滤日志,当然这样的东西网上应该大把,但是还是想自己搞下,权当学习!

#!/usr/bin/python # -*- encoding: utf-8 -*- # version 1.0 import re import time ''' 用于筛选日志文件,适用于python2.x版本 使用时将日志文件放于search.py工具同一目录 筛选完毕后会出现“旧文件名+当前时间”格式命名的新日志文件 ''' def getParameters(): file_name = "" key_work = "" while (True): file_name = raw_input("请输入文件名:") key_work = raw_input("请输入过滤关键字:") if len(file_name) == 0 or len(key_work) == 0: flag = raw_input("您输入的文件名或关键子为空,输出c重试,q退出程序:") if flag == "q": return elif flag == "c": continue else: break new_file = file_name + "-" + formatTime(time.localtime()) f = open("./" + file_name, "rb") lines = f.readlines() if len(lines) == 0: print("========日志文件为空========") f.close() return nf = open("./" + new_file, "wb"); count = 0 for line in lines: rs = re.search(key_work, line) if rs: print("[命中]--->%s" % line) nf.write(line) count = count + 1 f.close() nf.close() print("共找到%d条信息" % count) def formatTime(timevalue): ''' format the time numbers ''' return time.strftime("%Y%m%d%H%M%S", timevalue) if __name__ == '__main__': getParameters()

说明:这段脚本我是直接在终端上./xxxx.py的方式运行的,我终端由于编译android源码需要装的是python2.7.6,在python3上运行估计会有问题。

好了,下面是我测试了下的赛选结果:

当然,这只针对单个文件而已!

以上这篇python实现按关键字筛选日志文件就是小编分享给大家的全部内容了,希望能给大家一个参考,也希望大家多多支持软件开发网。

您可能感兴趣的文章:python 实现提取log文件中的关键句子,并进行统计分析Python中内置的日志模块logging用法详解Python的log日志功能及设置方法



关键字 日志文件 关键 Python

需要 登录 后方可回复, 如果你还没有账号请 注册新账号