Perl遍历目录和使用Linux命令分析日志的代码实例分享

所属分类: 脚本专栏 / perl 阅读数: 918
收藏 0 赞 0 分享

实例代码:

复制代码 代码如下:

#! /usr/bin/perl -w
$path = '/root/Documents';  # 当前工作目录
$dir = "$path/images"; # 要遍历的目录
$log_file = "$path/access_201209.log"; # nginx日志0903~0907,  filesize: 5.4G
$result_file = 'result.f';  # 放置结果的文件

if(!open $output, ">>$result_file") { # 以追加的形式打开文件
         die " Open file failed: $!";
}
&find_dir($dir);

sub find_dir() {
        my $base_dir = $_[0]; # $_[0]表示子例程(函数)的第一个参数
        if( !opendir(DIR,"$base_dir") ) {
                warn "open dir failed: $! \n";
        }
        my @father_dir = readdir(DIR); # 资源转储
        closedir(DIR);                 

        $base_dir =~ s/\/$//; # 删除目录最后面的 /
        foreach $sub_dir (@father_dir) {
                if($sub_dir =~ /^\./)  { # 过滤掉 . 和 .. 以及 隐藏文件
                        next;
                }

                if(-d "$base_dir/$sub_dir") { # 如果是目录则回调
                     &find_dir("$base_dir/$sub_dir"); # 引用递归函数,避免在内存中开辟多个副本

                }elsif (-f "$base_dir/$sub_dir") { # 如果是文件则....

                 # 文件前面保留一个空格,这样才能保证不会搜索到 theme_skin/blue/images 这样的目录
                 my $this_file = " $base_dir/$sub_dir";
                 $this_file =~ s/$path//;           # 删除掉字符串 /root/Documents

                 # 使用Linux命令,在 [$log_file文件] 中查找 [$this_file字符串] 并统计字符串出现的次数
                 my $result = `grep -c  "$this_file"  $log_file`;  # $this_file要用双引号括起来,防止图片名称中有空格造成程序错误
                 chomp  $result ;  # 删除Linux执行命令后,返回值所带有的换行符
                 print $output "$this_file :         $result \n";  # 将处理结果写入$output指定的文件

                 # 已经记录过的文件删除掉,这样每次终止脚本的时候,都能继续之前的内容进行查找
                 unlink "$base_dir/$sub_dir";
                }
        }
}

print "\n Finished \n";

# 现在打开 result.f 文件,把 /images/ 替换成 images/   这样才能在当前工作目录中删除文件
# Linux命令查找5天内被访问0次的记录,并删除
# 数字0 左右两边要有空格,防止找到文件名中含有0的记录

# 方法 1 :
# gawk -F ':' '$2 ~ / 0 / {print $1}' result.f | xargs rm -rf

# 方法 2 :  (完全等同 方法1)
# grep ' 0 ' result.f | gawk -F ':' '{print $1}' | xargs rm -rf

更多精彩内容其他人还在看

使用 use re debug 查看正则表达式的匹配过程

使用 use re 'debug' 查看正则表达式的匹配过程,参见如下的代码
收藏 0 赞 0 分享

perl中的$a和$b介绍

有关perl中的$a和$b,这两个变量是为sort函数准备的内置变量,所以声明时可以不加 my
收藏 0 赞 0 分享

perl用{}修饰变量名的写法分享

在perl中用{}修饰变量名,可以防止 _ 被解释为变量名的一部分
收藏 0 赞 0 分享

Perl使用File::Basename获取文件扩展名的代码

本文为大家介绍的这个例子,实现了获取/home/topgkw中所有文件后缀,其中目录返回空值
收藏 0 赞 0 分享

Perl 哈希Hash用法之入门教程

本文和大家重点讨论一下Perl Hash的用法,哈希是一种数据结构,和数组类似,但是,和数组不同的是,其索引不是数字,而是名字。也就是说,索引(这里,我们将它叫key)不是数字而是任意的唯一的字符串
收藏 0 赞 0 分享

perl哈希的一个实例分析

上一篇文章介绍了hash的入门教程,这篇文章为大家提供一个实例,方便大家深入学习
收藏 0 赞 0 分享

Perl哈希表用法解析

Perl语言有很多值得学习的地方,那么你对Perl哈希表的概念是否熟悉呢,这里和大家分享一下,希望本文的介绍能让你有所收获
收藏 0 赞 0 分享

Perl 哈希的创建和引用介绍

创建,引用仅有两种方法,使用它也是两种,这里简单介绍下, 方便需要的朋友
收藏 0 赞 0 分享

Perl 函数集小结

perl中常用的函数集合,特分享下,方便需要的朋友
收藏 0 赞 0 分享

perl的POD权限问题处理

今天我们继续查找mod_perl对req_header的处理,有需要的朋友建议参考学习之
收藏 0 赞 0 分享
查看更多