实例代码:
复制代码 代码如下:
#! /usr/bin/perl -w
$path = '/root/Documents'; # 当前工作目录
$dir = "$path/images"; # 要遍历的目录
$log_file = "$path/access_201209.log"; # nginx日志0903~0907, filesize: 5.4G
$result_file = 'result.f'; # 放置结果的文件
if(!open $output, "$result_file") { # 以追加的形式打开文件
die " Open file failed: $!";
}
&find_dir($dir);
sub find_dir() {
my $base_dir = $_[0]; # $_[0]表示子例程(函数)的第一个参数
if( !opendir(DIR,"$base_dir") ) {
warn "open dir failed: $! \n";
}
my @father_dir = readdir(DIR); # 资源转储
closedir(DIR);
$base_dir =~ s/\/$//; # 删除目录最后面的 /
foreach $sub_dir (@father_dir) {
if($sub_dir =~ /^\./) { # 过滤掉 . 和 .. 以及 隐藏文件
next;
}
if(-d "$base_dir/$sub_dir") { # 如果是目录则回调
&find_dir("$base_dir/$sub_dir"); # 引用递归函数,避免在内存中开辟多个副本
}elsif (-f "$base_dir/$sub_dir") { # 如果是文件则....
# 文件前面保留一个空格,这样才能保证不会搜索到 theme_skin/blue/images 这样的目录
my $this_file = " $base_dir/$sub_dir";
$this_file =~ s/$path//; # 删除掉字符串 /root/Documents
# 使用Linux命令,在 [$log_file文件] 中查找 [$this_file字符串] 并统计字符串出现的次数
my $result = `grep -c "$this_file" $log_file`; # $this_file要用双引号括起来,防止图片名称中有空格造成程序错误
chomp $result ; # 删除Linux执行命令后,返回值所带有的换行符
print $output "$this_file : $result \n"; # 将处理结果写入$output指定的文件
# 已经记录过的文件删除掉,这样每次终止脚本的时候,都能继续之前的内容进行查找
unlink "$base_dir/$sub_dir";
}
}
}
print "\n Finished \n";
# 现在打开 result.f 文件,把 /images/ 替换成 images/ 这样才能在当前工作目录中删除文件
# Linux命令查找5天内被访问0次的记录,并删除
# 数字0 左右两边要有空格,防止找到文件名中含有0的记录
# 方法 1 :
# gawk -F ':' '$2 ~ / 0 / {print $1}' result.f | xargs rm -rf
# 方法 2 : (完全等同 方法1)
# grep ' 0 ' result.f | gawk -F ':' '{print $1}' | xargs rm -rf
免责声明:本站资源来自互联网收集,仅供用于学习和交流,请遵循相关法律法规,本站一切资源不代表本站立场,如有侵权、后门、不妥请联系本站删除!
更新日志
- 小骆驼-《草原狼2(蓝光CD)》[原抓WAV+CUE]
- 群星《欢迎来到我身边 电影原声专辑》[320K/MP3][105.02MB]
- 群星《欢迎来到我身边 电影原声专辑》[FLAC/分轨][480.9MB]
- 雷婷《梦里蓝天HQⅡ》 2023头版限量编号低速原抓[WAV+CUE][463M]
- 群星《2024好听新歌42》AI调整音效【WAV分轨】
- 王思雨-《思念陪着鸿雁飞》WAV
- 王思雨《喜马拉雅HQ》头版限量编号[WAV+CUE]
- 李健《无时无刻》[WAV+CUE][590M]
- 陈奕迅《酝酿》[WAV分轨][502M]
- 卓依婷《化蝶》2CD[WAV+CUE][1.1G]
- 群星《吉他王(黑胶CD)》[WAV+CUE]
- 齐秦《穿乐(穿越)》[WAV+CUE]
- 发烧珍品《数位CD音响测试-动向效果(九)》【WAV+CUE】
- 邝美云《邝美云精装歌集》[DSF][1.6G]
- 吕方《爱一回伤一回》[WAV+CUE][454M]