假设我有以下文字:
today was a good day and today was a sunny day.
Run Code Online (Sandbox Code Playgroud)
我把这个文本分成几行,用白色空格分隔,这是
Today
was
a
good
Run Code Online (Sandbox Code Playgroud)
等等
现在我使用矢量数据结构通过.size()简单计算文本中的单词数.那已经完成了.
但是,我还要检查一个单词是否出现不止一次,如果出现,有多少时间.在我的例子中,"今天"出现2次.
我想存储"今天"并附加2/x(取决于它在大文本中出现的频率).现在,这不仅仅是针对"今天",而是针对文本中的每一个字.我想查找一个单词出现的频率,附加一个计数器,然后按降序排序(单词+计数器)(这是另一件事,但现在不重要).
我不确定在这里使用哪种数据结构.也许是地图?但是我无法添加计数器来映射.
编辑:这是我到目前为止所做的:http://pastebin.com/JncR4kw9