更新:
在我最初的帖子和回复之后,我设法再次破解并更清晰地写下了我的目标和结果:
目标:
我正在尝试计算日志文件的搜索字符串中的命中次数,以找出通过以下方式生成了多少次消息:
- 每天总计。
- 每小时总计。
- 最高每分钟,每小时。
- 最高每秒,每小时。
我的工作代码:
#!/usr/bin/perl
#use strict;
use warnings;
use Data::Dumper;
my @a = (
[ qw /2012-02-21_09:43:43/ ],
[ qw /2012-02-21_09:43:43/ ],
[ qw /2012-02-21_09:43:44/ ],
[ qw /2012-02-21_09:43:44/ ],
[ qw /2012-02-21_09:43:44/ ],
[ qw /2012-02-21_09:43:45/ ],
[ qw /2012-02-21_09:43:45/ ],
[ qw /2012-02-21_09:43:45/ ],
[ qw /2012-02-21_09:43:45/ ],
[ qw /2012-02-21_09:44:47/ ],
[ qw /2012-02-21_09:44:47/ ],
[ qw /2012-02-22_09:44:49/ ],
[ qw /2012-02-21_10:44:49/ ]
);
my ( %count, $count ) = ();
foreach (@a) {
my $line = @$_[0] ;
$line =~ /(\S+)_(\d+):(\d+):(\d+)/ ;
my $day = $1;
my $hour= $2;
my $min = $3;
my $sec = $4;
$count {$day}->{$hour}->{$min}->{$sec}{'sec'} += 1 ;
$count {$day}->{$hour}->{$min}{'min'} += 1 ;
$count {$day}->{$hour}{'hour'} += 1 ;
$count {$day}{'day'} += 1 ;
}
#print Dumper (%count) . "\n";
foreach my $k1 ( sort keys %count ) {
print "$k1\t$count{$k1}{'day'}\n" ;
foreach my $k2 ( sort keys %{$count{$k1}} ) {
if ($k2 =~ /day/) {
next;
}
print " $k2:00\t\t$count{$k1}{$k2}->{'hour'}\n";
foreach my $k3 ( sort keys %{$count{$k1}{$k2}} ) {
if ($k3 =~ /hour/) {
next;
}
print " $k2:$k3\t\t$count{$k1}{$k2}{$k3}->{'min'}\n";
foreach my $k4 ( sort keys %{$count{$k1}{$k2}{$k3}} ) {
if ($k4 =~ /min/) {
next;
}
print " $k2:$k3:$k4\t$count{$k1}{$k2}{$k3}{$k4}->{'sec'}\n";
}
print "\n";
}
print "\n";
}
}
exit;
结果
由于我糟糕的哈希解除引用方法,我不得不关闭严格(我很惭愧)。
2012-02-21 12
09:00 11
09:43 9
09:43:43 2
09:43:44 3
09:43:45 4
09:44 2
09:44:47 2
10:00 1
10:44 1
10:44:49 1
尝试输出:
2012-02-21 12
09:00 11
09:43 9
09:43:45 4
10:00 1
10:44 1
10:44:49 1
问题:
- 有没有更好的方法来编写代码并打开严格?
- 我将如何列出哈希值中出现次数最多的哈希值,以尝试仅列出最高计数?
感谢之前的所有帖子,如果没有他们,我不可能走到这一步。
干杯,
安迪