Perl遍历目录和使用Linux命令分析日志的代码实例分享
实例代码:
代码如下:
#! /usr/bin/perl -w $path = '/root/Documents'; # 当前工作目录 $dir = "$path/images"; # 要遍历的目录 $log_file = "$path/access_201209.log"; # nginx日志0903~0907, filesize: 5.4G $result_file = 'result.f'; # 放置结果的文件 if(!open $output, ">>$result_file") { # 以追加的形式打开文件 die " Open file failed: $!"; } &find_dir($dir); sub find_dir() { my $base_dir = $_[0]; # $_[0]表示子例程(函数)的第一个参数 if( !opendir(DIR,"$base_dir") ) { warn "open dir failed: $! \n"; } my @father_dir = readdir(DIR); # 资源转储 closedir(DIR); $base_dir =~ s/\/$//; # 删除目录最后面的 / foreach $sub_dir (@father_dir) { if($sub_dir =~ /^\./) { # 过滤掉 . 和 .. 以及 隐藏文件 next; } if(-d "$base_dir/$sub_dir") { # 如果是目录则回调 &find_dir("$base_dir/$sub_dir"); # 引用递归函数,避免在内存中开辟多个副本 }elsif (-f "$base_dir/$sub_dir") { # 如果是文件则.... # 文件前面保留一个空格,这样才能保证不会搜索到 theme_skin/blue/images 这样的目录 my $this_file = " $base_dir/$sub_dir"; $this_file =~ s/$path//; # 删除掉字符串 /root/Documents # 使用Linux命令,在 [$log_file文件] 中查找 [$this_file字符串] 并统计字符串出现的次数 my $result = `grep -c "$this_file" $log_file`; # $this_file要用双引号括起来,防止图片名称中有空格造成程序错误 chomp $result ; # 删除Linux执行命令后,返回值所带有的换行符 print $output "$this_file : $result \n"; # 将处理结果写入$output指定的文件 # 已经记录过的文件删除掉,这样每次终止脚本的时候,都能继续之前的内容进行查找 unlink "$base_dir/$sub_dir"; } } } print "\n Finished \n"; # 现在打开 result.f 文件,把 /images/ 替换成 images/ 这样才能在当前工作目录中删除文件 # Linux命令查找5天内被访问0次的记录,并删除 # 数字0 左右两边要有空格,防止找到文件名中含有0的记录 # 方法 1 : # gawk -F ':' '$2 ~ / 0 / {print $1}' result.f | xargs rm -rf # 方法 2 : (完全等同 方法1) # grep ' 0 ' result.f | gawk -F ':' '{print $1}' | xargs rm -rf
相关推荐
farwang 2020-11-25
星愿心愿 2020-11-24
tianhuak 2020-11-24
zhjn0 2020-11-24
昭君出塞 2020-11-23
bluecarrot 2020-11-23
linuxwcj 2020-10-21
以梦为马不负韶华 2020-10-20
彼岸随笔 2020-10-20
yutou0 2020-10-17
applecarelte 2020-10-16
ourtimes 2020-10-16
waterhorse 2020-09-19
MRFENGG 2020-11-11
rainandtear 2020-10-30
kyssfanhui 2020-10-20
liuhangtiant 2020-10-20