使用pandas的get_dummies对类目型的特征因子化

以Cabin为例,原本一个属性维度,因为其取值可以是[‘yes’,‘no’],而将其平展开为’Cabin_yes’,'Cabin_no’两个属性

原本Cabin取值为yes的,在此处的"Cabin_yes"下取值为1,在"Cabin_no"下取值为0
原本Cabin取值为no的,在此处的"Cabin_yes"下取值为0,在"Cabin_no"下取值为1

dummies_Cabin = pd.get_dummies(data_train['Cabin'], prefix= 'Cabin')
print(dummies_Cabin.head())
  • 输出
   Cabin_No  Cabin_Yes
0         1          0
1         0          1
2         1          0
3         0          1
4         1          0
posted @ 2019-08-10 11:20  Rener  阅读(406)  评论(0编辑  收藏  举报