python写的一个squid访问日志分析的小程序
admin
2023-07-31 02:13:03
0

这两周组里面几位想学习python,于是我们就创建了一个这样的环境和氛围来给大家学习。

昨天在群里,贴了一个需求,就是统计squid访问日志中ip 访问数和url的访问数并排序,不少同学都大体实现了相应的功能,我把我简单实现的贴出来,欢迎拍砖:

日志格式如下:

复制代码 代码如下:
%ts.%03tu %6tr %{X-Forwarded-For}>h %Ss/%03Hs %h\” \”%{User-Agent}>h\” %{Cookie}>h

复制代码 代码如下:
1372776321.285      0 100.64.19.225 TCP_HIT/200 8560 GET http://img1.jb51.net/games/0908/19/1549401_3_80x100.jpg  – NONE/- image/jpeg \”http://www.jb51.net/\” \”Mozilla/4.0 (compatible; MSIE 8.0; Windows NT 5.1; Trident/4.0; QQDownload 734; .NET4.0C; .NET CLR 2.0.50727)\” pcsuv=0;%20pcuvdata=lastAccessTime=1372776317582;%20u4ad=33480hn;%20c=14arynt;%20uf=1372776310453

复制代码 代码如下:
#!/usr/bin/python
# -*- coding: utf-8 -*-
import sys
from optparse import OptionParser
\’\’\’
    仅仅是一个关于日志文件的测试,统计处access.log 的ip数目
\’\’\’
try:
    f = open(\’/data/proclog/log/squid/access.log\’)
except IOError,e:
    print \”can\’t open the file:%s\” %(e)
 
def log_report(field):
    \’\’\’
        return the field of the access log
    \’\’\’
    if field == \”ip\”:
        return  [line.split()[2] for line in f]
    if field == \”url\”:
        return  [line.split()[6] for line in f]
def log_count(field):
    \’\’\’
        return a dict of like {field:number}
    \’\’\’
    fields2 = {}
    fields = log_report(field)
    for field_tmp in fields:
        if field_tmp in fields2:
            fields2[field_tmp] += 1
        else:
            fields2[field_tmp] = 1
    return fields2
def log_sort(field,number = 10 ,reverse = True):
    \’\’\’
        print the sorted fields to output
    \’\’\’
    for v in sorted(log_count(field).iteritems(),key = lambda x:x[1] , reverse = reverse )[0:int(number)]:
        print v[1],v[0]
if __name__ == \”__main__\”:
    parser =OptionParser(usage=\”%prog [-i|-u] [-n num | -r]\” ,version = \”1.0\”)
    parser.add_option(\’-n\’,\’–number\’,dest=\”number\”,type=int,default=10,help=\” print top line of the ouput\”)
    parser.add_option(\’-i\’,\’–ip\’,dest=\”ip\”,action = \”store_true\”,help=\”print ip information of access log\”)
    parser.add_option(\’-u\’,\’–url\’,dest=\”url\”,action = \”store_true\”,help=\”print url information of access log\”)
    parser.add_option(\’-r\’,\’–reverse\’,action = \”store_true\”,dest=\”reverse\”,help=\”reverse output \”)
    (options,args) = parser.parse_args()
 
    if len(sys.argv) < 2:
        parser.print_help()
    if options.ip and options.url:
         parser.error(\’ -i and -u  can not be execute at the same time \’)
    if options.ip :
        log_sort(\”ip\”, options.number , True and options.reverse  or False)
    if options.url:
        log_sort(\”url\”, options.number , True and  options.reverse or False)
 
    f.close()

效果如下:

相关内容

热门资讯

Mobi、epub格式电子书如... 在wps里全局设置里有一个文件关联,打开,勾选电子书文件选项就可以了。
500 行 Python 代码... 语法分析器描述了一个句子的语法结构,用来帮助其他的应用进行推理。自然语言引入了很多意外的歧义,以我们...
定时清理删除C:\Progra... C:\Program Files (x86)下面很多scoped_dir开头的文件夹 写个批处理 定...
scoped_dir32_70... 一台虚拟机C盘总是莫名奇妙的空间用完,导致很多软件没法再运行。经过仔细检查发现是C:\Program...
65536是2的几次方 计算2... 65536是2的16次方:65536=2⁶ 65536是256的2次方:65536=256 6553...
小程序支付时提示:appid和... [Q]小程序支付时提示:appid和mch_id不匹配 [A]小程序和微信支付没有进行关联,访问“小...
pycparser 是一个用... `pycparser` 是一个用 Python 编写的 C 语言解析器。它可以用来解析 C 代码并构...
微信小程序使用slider实现... 众所周知哈,微信小程序里面的音频播放是没有进度条的,但最近有个项目呢,客户要求音频要有进度条控制,所...
Apache Doris 2.... 亲爱的社区小伙伴们,我们很高兴地向大家宣布,Apache Doris 2.0.0 版本已于...
python清除字符串里非数字... 本文实例讲述了python清除字符串里非数字字符的方法。分享给大家供大家参考。具体如下: impor...