【发布时间】:2019-10-07 04:46:27
【问题描述】:
我想生成一个输出文件,显示输入文件中每个单词的频率。经过一番搜索,我发现 Perl 是解决这个问题的理想语言,但我不知道这种语言。
经过一番搜索,我在stackoverflow找到了以下代码,据说它提供了我想要的解决方案,效率很高:
perl -lane '$h{$_}++ for @F; END{for $w (sort {$h{$b}<=>$h{$a} || $a cmp $b} keys %h) {print "$h{$w}\t$w"}}' file > freq
我尝试使用以下形式运行此命令行:
perl -lane 'code' input.txt > output.txt
由于意外的“>”(“”处的那个),执行停止。我做了一些研究,但不明白出了什么问题。 有人能启发我吗?谢谢!
这是我获得代码的主题: Elegant ways to count the frequency of words in a file
如果相关,我的文字使用字母和数字,并用一个空格分隔。
【问题讨论】:
-
您可能想查看这篇关于 Perl Maven 的文章,解释如何编写脚本来生成词频。 perlmaven.com/count-words-in-text-using-perl
-
实际的错误信息是什么?
标签: perl frequency-distribution