相关疑难解决方法(0)

使用Scikit Learn SVM准备文本分类数据

我正在尝试从Scikit应用SVM学习对我收集的推文进行分类.因此,将有两个类别,将它们命名为A和B.现在,我将所有推文分类为两个文本文件"A.txt"和"B.txt".但是,我不确定Scikit Learn SVM要求的数据输入类型.我有一个字典,标签(A和B)作为其键和特征字典(unigrams)及其频率作为值.对不起,我是机器学习的新手,不知道如何让SVM工作.我发现SVM使用numpy.ndarray作为其数据输入的类型.我是否需要根据自己的数据创建一个?它应该是这样的吗?

Labels    features    frequency
  A        'book'        54
  B       'movies'       32
Run Code Online (Sandbox Code Playgroud)

任何帮助表示赞赏.

python svm scikit-learn

11
推荐指数
1
解决办法
3万
查看次数

标签 统计

python ×1

scikit-learn ×1

svm ×1