我正在使用一个sklearn.pipeline.Pipeline对象来进行聚类.
pipe = sklearn.pipeline.Pipeline([('transformer1': transformer1),
('transformer2': transformer2),
('clusterer': clusterer)])
Run Code Online (Sandbox Code Playgroud)
然后我通过使用轮廓分数来评估结果.
sil = preprocessing.silhouette_score(X, y)
Run Code Online (Sandbox Code Playgroud)
我想知道如何X从管道获取或转换数据,因为它只返回clusterer.fit_predict(X).
我知道我可以通过将管道拆分为:
pipe = sklearn.pipeline.Pipeline([('transformer1': transformer1),
('transformer2': transformer2)])
X = pipe.fit_transform(data)
res = clusterer.fit_predict(X)
sil = preprocessing.silhouette_score(X, res)
Run Code Online (Sandbox Code Playgroud)
但我想在一个管道中完成所有工作.