python写的一个squid访问日志分析的小程序

作者:乡村运维 时间:2021-08-02 14:09:09 

这两周组里面几位想学习python,于是我们就创建了一个这样的环境和氛围来给大家学习。

昨天在群里,贴了一个需求,就是统计squid访问日志中ip 访问数和url的访问数并排序,不少同学都大体实现了相应的功能,我把我简单实现的贴出来,欢迎拍砖:

日志格式如下:


%ts.%03tu %6tr %{X-Forwarded-For}>h %Ss/%03Hs %<st %rm %ru  %un %Sh/%<A %mt "%{Referer}>h" "%{User-Agent}>h" %{Cookie}>h


1372776321.285      0 100.64.19.225 TCP_HIT/200 8560 GET http://img1.jb51.net/games/0908/19/1549401_3_80x100.jpg  - NONE/- image/jpeg "https://www.jb51.net/" "Mozilla/4.0 (compatible; MSIE 8.0; Windows NT 5.1; Trident/4.0; QQDownload 734; .NET4.0C; .NET CLR 2.0.50727)" pcsuv=0;%20pcuvdata=lastAccessTime=1372776317582;%20u4ad=33480hn;%20c=14arynt;%20uf=1372776310453


#!/usr/bin/python
# -*- coding: utf-8 -*-
import sys
from optparse import OptionParser
'''
    仅仅是一个关于日志文件的测试,统计处access.log 的ip数目
'''
try:
    f = open('/data/proclog/log/squid/access.log')
except IOError,e:
    print "can't open the file:%s" %(e)
 
def log_report(field):
    '''
        return the field of the access log
    '''
    if field == "ip":
        return  [line.split()[2] for line in f]
    if field == "url":
        return  [line.split()[6] for line in f]
def log_count(field):
    '''
        return a dict of like {field:number}
    '''
    fields2 = {}
    fields = log_report(field)
    for field_tmp in fields:
        if field_tmp in fields2:
            fields2[field_tmp] += 1
        else:
            fields2[field_tmp] = 1
    return fields2
def log_sort(field,number = 10 ,reverse = True):
    '''
        print the sorted fields to output
    '''
    for v in sorted(log_count(field).iteritems(),key = lambda x:x[1] , reverse = reverse )[0:int(number)]:
        print v[1],v[0]
if __name__ == "__main__":
    parser =OptionParser(usage="%prog [-i|-u] [-n num | -r]" ,version = "1.0")
    parser.add_option('-n','--number',dest="number",type=int,default=10,help=" print top line of the ouput")
    parser.add_option('-i','--ip',dest="ip",action = "store_true",help="print ip information of access log")
    parser.add_option('-u','--url',dest="url",action = "store_true",help="print url information of access log")
    parser.add_option('-r','--reverse',action = "store_true",dest="reverse",help="reverse output ")
    (options,args) = parser.parse_args()
 
    if len(sys.argv) < 2:
        parser.print_help()
    if options.ip and options.url:
         parser.error(' -i and -u  can not be execute at the same time ')
    if options.ip :
        log_sort("ip", options.number , True and options.reverse  or False)
    if options.url:
        log_sort("url", options.number , True and  options.reverse or False)
 
    f.close()

效果如下:

python写的一个squid访问日志分析的小程序

python写的一个squid访问日志分析的小程序

标签:python,squid,访问日志分析
0
投稿

猜你喜欢

  • python和pywin32实现窗口查找、遍历和点击的示例代码

    2023-04-06 19:01:23
  • js实现点击后将文字或图片复制到剪贴板的方法

    2024-04-30 09:51:07
  • Python绘制词云图之可视化神器pyecharts

    2023-02-23 01:35:25
  • pytorch中的embedding词向量的使用方法

    2022-03-25 09:05:27
  • Python格式化输出%s和%d

    2021-05-02 14:13:08
  • 5个css+div导航菜单

    2011-04-29 12:38:00
  • 99%的程序员都会收藏的书单 你读过几本?

    2022-10-01 19:45:59
  • python 自动化将markdown文件转成html文件的方法

    2021-09-16 16:04:40
  • MySQL SQL预处理(Prepared)的语法实例与注意事项

    2024-01-14 17:50:09
  • asp如何做一个树状展开视图来显示自己的记录结构?

    2010-07-12 18:56:00
  • 如何利用pyecharts画好看的饼状图

    2021-04-19 09:07:19
  • Python装饰器如何实现修复过程解析

    2023-11-22 04:27:43
  • Python字符串类型及格式化问题

    2023-12-30 21:49:46
  • Python编写电话薄实现增删改查功能

    2021-07-14 21:28:18
  • 13个你希望早点知道的实用WordPress SQL查询语句[译]

    2010-02-28 12:48:00
  • Vue使用Echarts图表多次初始化报错问题的解决方法

    2023-07-02 16:49:54
  • FFrpc python客户端lib使用解析

    2023-09-06 00:12:20
  • mysql之查找所有数据库中没有主键的表问题

    2024-01-12 15:27:19
  • MySQL 中查找含有目标字段的表的方法

    2024-01-12 16:45:20
  • ASP UTF-8页面乱码+GB2312转UTF-8 +生成UTF-8格式的文件(编码)

    2011-04-19 11:15:00
  • asp之家 网络编程 m.aspxhome.com