如何从文件linux中找到独特的单词

jan*_*345 5 linux bash terminal ubuntu

我有一个大文件,线条看起来像这个文本数字等[男人 - (一些数字)]很多这个男人 - 有些人在几行重复,我想只计算独特的芒字.我不能使用唯一文件,因为Man字之前的文字在每一行总是不同的.我怎样才能算出文件中唯一的Man-somenumbers单词?

Win*_*ute 8

如果我明白你想要做什么,那么

grep -oE 'Man-[0-9]+' filename | sort | uniq -c
Run Code Online (Sandbox Code Playgroud)

应该做的伎俩.它的工作原理如下:首先

grep -oE 'Man-[0-9]+' filename
Run Code Online (Sandbox Code Playgroud)

隔离文件中与Man-[0-9]+正则表达式匹配的所有单词.然后通过管道传递该列表sort以获得所需的排序列表,uniq然后通过管道传递该排序列表uniq -c以计算每个唯一Man-单词出现的频率.