国产探花免费观看_亚洲丰满少妇自慰呻吟_97日韩有码在线_资源在线日韩欧美_一区二区精品毛片,辰东完美世界有声小说,欢乐颂第一季,yy玄幻小说排行榜完本

首頁 > 編程 > Python > 正文

python寫的一個(gè)squid訪問日志分析的小程序

2019-11-25 18:13:09
字體:
供稿:網(wǎng)友

這兩周組里面幾位想學(xué)習(xí)python,于是我們就創(chuàng)建了一個(gè)這樣的環(huán)境和氛圍來給大家學(xué)習(xí)。

昨天在群里,貼了一個(gè)需求,就是統(tǒng)計(jì)squid訪問日志中ip 訪問數(shù)和url的訪問數(shù)并排序,不少同學(xué)都大體實(shí)現(xiàn)了相應(yīng)的功能,我把我簡(jiǎn)單實(shí)現(xiàn)的貼出來,歡迎拍磚:

日志格式如下:

復(fù)制代碼 代碼如下:

%ts.%03tu %6tr %{X-Forwarded-For}>h %Ss/%03Hs %<st %rm %ru  %un %Sh/%<A %mt "%{Referer}>h" "%{User-Agent}>h" %{Cookie}>h

復(fù)制代碼 代碼如下:

1372776321.285      0 100.64.19.225 TCP_HIT/200 8560 GET http://img1.VeVB.COm/games/0908/19/1549401_3_80x100.jpg  - NONE/- image/jpeg "http://m.survivalescaperooms.com/" "Mozilla/4.0 (compatible; MSIE 8.0; Windows NT 5.1; Trident/4.0; QQDownload 734; .NET4.0C; .NET CLR 2.0.50727)" pcsuv=0;%20pcuvdata=lastAccessTime=1372776317582;%20u4ad=33480hn;%20c=14arynt;%20uf=1372776310453

復(fù)制代碼 代碼如下:

#!/usr/bin/python
# -*- coding: utf-8 -*-
import sys
from optparse import OptionParser
'''
    僅僅是一個(gè)關(guān)于日志文件的測(cè)試,統(tǒng)計(jì)處access.log 的ip數(shù)目
'''
try:
    f = open('/data/proclog/log/squid/access.log')
except IOError,e:
    print "can't open the file:%s" %(e)
 
def log_report(field):
    '''
        return the field of the access log
    '''
    if field == "ip":
        return  [line.split()[2] for line in f]
    if field == "url":
        return  [line.split()[6] for line in f]
def log_count(field):
    '''
        return a dict of like {field:number}
    '''
    fields2 = {}
    fields = log_report(field)
    for field_tmp in fields:
        if field_tmp in fields2:
            fields2[field_tmp] += 1
        else:
            fields2[field_tmp] = 1
    return fields2
def log_sort(field,number = 10 ,reverse = True):
    '''
        print the sorted fields to output
    '''
    for v in sorted(log_count(field).iteritems(),key = lambda x:x[1] , reverse = reverse )[0:int(number)]:
        print v[1],v[0]
if __name__ == "__main__":
    parser =OptionParser(usage="%prog [-i|-u] [-n num | -r]" ,version = "1.0")
    parser.add_option('-n','--number',dest="number",type=int,default=10,help=" print top line of the ouput")
    parser.add_option('-i','--ip',dest="ip",action = "store_true",help="print ip information of access log")
    parser.add_option('-u','--url',dest="url",action = "store_true",help="print url information of access log")
    parser.add_option('-r','--reverse',action = "store_true",dest="reverse",help="reverse output ")
    (options,args) = parser.parse_args()
 
    if len(sys.argv) < 2:
        parser.print_help()
    if options.ip and options.url:
         parser.error(' -i and -u  can not be execute at the same time ')
    if options.ip :
        log_sort("ip", options.number , True and options.reverse  or False)
    if options.url:
        log_sort("url", options.number , True and  options.reverse or False)
 
    f.close()

效果如下:

發(fā)表評(píng)論 共有條評(píng)論
用戶名: 密碼:
驗(yàn)證碼: 匿名發(fā)表
主站蜘蛛池模板: 南江县| 新闻| 房山区| 连州市| 东乡县| 裕民县| 兴化市| 绍兴县| 通海县| 太保市| 平陆县| 西盟| 苏尼特左旗| 民丰县| 塔城市| 临湘市| 潢川县| 抚宁县| 太白县| 凉城县| 永顺县| 南和县| 松滋市| 开平市| 吉首市| 广州市| 云梦县| 宜章县| 玛沁县| 晋宁县| 乌恰县| 隆昌县| 阳江市| 临泉县| 寿宁县| 舟山市| 菏泽市| 防城港市| 伊吾县| 高台县| 蕉岭县|