Mon*_*RPG 4 svm knn document-classification text-classification
几乎所有的例子都基于数字.在文本文档中,我有单词而不是数字.
那么你能告诉我如何使用这些算法进行文本文档分类的简单例子.
我不需要代码示例,只需要逻辑
伪代码会有很大帮助
常见的方法是使用一个单词模型(http://en.wikipedia.org/wiki/Bag_of_words_model),其中分类器将学习文本中单词的存在,它很简单,但工作得非常好.
此外,还有一个类似的问题:使用Scikit Learn SVM准备文本分类数据
| 归档时间: |
|
| 查看次数: |
10145 次 |
| 最近记录: |