前往小程序,Get更优阅读体验!
立即前往
首页
学习
活动
专区
工具
TVP
发布
社区首页 >专栏 >pandas.get_dummies 的用法

pandas.get_dummies 的用法

作者头像
周小董
发布2019-03-25 10:54:51
10.3K0
发布2019-03-25 10:54:51
举报
文章被收录于专栏:python前行者python前行者

get_dummies 是利用pandas实现one hot encode的方式。详细参数请查看官方文档

pandas.get_dummies(data, prefix=None, prefix_sep=’_’, dummy_na=False, columns=None, sparse=False, drop_first=False)[source]

参数说明:

  • data : array-like, Series, or DataFrame 输入的数据
  • prefix : string, list of strings, or dict of strings, default None get_dummies转换后,列名的前缀
  • columns : list-like, default None 指定需要实现类别转换的列名
  • dummy_na : bool, default False 增加一列表示空缺值,如果False就忽略空缺值
  • drop_first : bool, default False 获得k中的k-1个类别值,去除第一个

离散特征的编码分为两种情况:

1、离散特征的取值之间没有大小的意义,比如color:[red,blue],那么就使用one-hot编码

2、离散特征的取值有大小的意义,比如size:[X,XL,XXL],那么就使用数值的映射{X:1,XL:2,XXL:3}

例子:

代码语言:javascript
复制
import pandas as pd

df = pd.DataFrame([  
            ['green' , 'A'],   
            ['red'   , 'B'],   
            ['blue'  , 'A']])  

df.columns = ['color',  'class'] 
pd.get_dummies(df) 

get_dummies 前: 

get_dummies 前
get_dummies 前

get_dummies 后: 

get_dummies 后
get_dummies 后

上述执行完以后再打印df 出来的还是get_dummies 前的图,因为你没有写

代码语言:javascript
复制
df = pd.get_dummies(df)

可以对指定列进行get_dummies

代码语言:javascript
复制
pd.get_dummies(df.color)
这里写图片描述
这里写图片描述

将指定列进行get_dummies 后合并到元数据中

代码语言:javascript
复制
df = df.join(pd.get_dummies(df.color))
这里写图片描述
这里写图片描述

参考:https://blog.csdn.net/maymay_/article/details/80198468 https://blog.csdn.net/u010712012/article/details/83002388

本文参与 腾讯云自媒体分享计划,分享自作者个人站点/博客。
原始发表:2018年12月12日,如有侵权请联系 cloudcommunity@tencent.com 删除

本文分享自 作者个人站点/博客 前往查看

如有侵权,请联系 cloudcommunity@tencent.com 删除。

本文参与 腾讯云自媒体分享计划  ,欢迎热爱写作的你一起参与!

评论
登录后参与评论
0 条评论
热度
最新
推荐阅读
领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档