小编rob*_*ero的帖子

应用 sklearn.compose.ColumnTransformer 后保留列顺序

我正在使用库中的模块Pipeline对我的数据集执行特征工程。ColumnTransformersklearn

数据集最初看起来像这样:

日期 日期块编号 店铺ID 商品编号 商品价格
2013年1月2日 0 59 22154 999.00
2013年1月3日 0 25 2552 899.00
2013年1月5日 0 25 2552 899.00
2013年1月6日 0 25 2554 1709.05
2013年1月15日 0 25 2555 1099.00
$> data.info()
<class 'pandas.core.frame.DataFrame'>
RangeIndex: 2935849 entries, 0 to 2935848
Data columns (total 6 columns):
 #   Column          Dtype  
---  ------          -----  
 0   date            object 
 1   date_block_num  object  
 2   shop_id         object  
 3   item_id         object  
 4   item_price      float64
dtypes: float64(2), int64(3), object(1)
memory usage: 134.4+ MB …
Run Code Online (Sandbox Code Playgroud)

python pandas scikit-learn data-science

16
推荐指数
1
解决办法
6218
查看次数

标签 统计

data-science ×1

pandas ×1

python ×1

scikit-learn ×1