Pandas数据清洗的7种方式!

Pandas数据清洗的7种方式!

 

1.处理数据中的空值

我们在处理真实的数据时,往往会有很多缺少的的特征数据,就是所谓的空值,必须要进行处理才能进行下一步分析

空值的处理方式有很多种,一般是删除或者填充

Excel通过“查找和替换”功能实现空值的统一替换:

cb3d77c0dec04f919b494b60a652d299

通过“定位”删除空值:

47b4d8f0c7df4496ab33d7709ff2aa41

pandas处理空值的方式比较灵活,可以使用dropna函数删除空值

import pandas as pd
data=pd.read_csv('成绩表.csv',encoding='gbk')
data.dropna(how='any')

95a0942e89174b55b3a69dee7324b611

74a30ec8285c4b6bacadd99dcbe8a0c5

用fillna函数实现空值的填充

①使用数字0填充数据表中的空值

data.fillna(value=0)  

8e6aca81d40446d4ae2300327010518e

②使用平均值填充数据表中的空值

data['语文'].fillna(data['语文'].mean())

0e771ef33ba743ecb0800b13ab0fe214

2.删除空格

excel中清理空格很简单,直接替换即可

pandas删除空格也很方便,主要使用map函数

data['姓名']=data['姓名'].map(str.strip)
data

96dbaafb2f2046cabd4fd8588364ac0d

3.大小写转换

excel中大小写转换函数分别为upper()和lower()

pandas中转换函数也为upper()和lower()

data['拼音']=data['拼音'].str.upper()
data

fc9030fb21c0467b92e27d022b95536d

data['拼音']=data['拼音'].str.lower()
data

084d2cb437ef4dc4ab77fba36e1a6788

4.更改数据格式

excel中更改数据格式通过快捷键“ctrl+1”打开“设置单元格格式”:

a588d7c60aef4bbdbd81c5da6295537b

pandas使用astype来修改数据格式,以将“语文”列改成整数为例

data['语文'].dropna(how='any').astype('int')

89dd9a47b9c14f7abe96686ce2aa1f88

5.更改列名称

excel中更改列名称就不说了,大家都会

pandas使用rename函数更改列名称,代码如下:

data.rename(columns={'语文':'语文成绩'})

420ba97948184edf95562f15ae6e72f6

6.删除重复值

excel的功能区“数据”下有“删除重复项”,可以用来删除表中的重复值,默认保留最第一个重复值,把后面的删除:

f07a2578c04b46859cb9415c6187aef3

pandas使用drop_duplicates函数删除重复值:

data['数学'].drop_duplicates()  #默认删除后面的重复值
data['数学'].drop_duplicates(keep='last')  #删除第一项重复值

7.修改及替换数据

excel中使用“查找和替换”功能实现数值的替换

pandas中使用replace函数实现数据替换

data['姓名'].replace('成  功','失  败')

END -

 

学习资料见知识星球。

以上就是今天要分享的技巧,你学会了吗?若有什么问题,欢迎在下方留言。

快来试试吧,小琥 my21ke007。获取 1000个免费 Excel模板福利​​​​!

更多技巧, www.excelbook.cn

欢迎 加入 零售创新 知识星球,知识星球主要以数据分析、报告分享、数据工具讨论为主;

电商数据分析360°实战攻略!

你将获得:

1、价值上万元的专业的PPT报告模板。

2、专业案例分析和解读笔记。

3、实用的Excel、Word、PPT技巧。

4、VIP讨论群,共享资源。

5、优惠的会员商品。

6、一次付费只需129元,即可下载本站文章涉及的文件和软件。

文章版权声明 1、本网站名称:Excelbook
2、本站永久网址:http://www.excelbook.cn
3、本网站的文章部分内容可能来源于网络,仅供大家学习与参考,如有侵权,请联系站长王小琥进行删除处理。
4、本站一切资源不代表本站立场,并不代表本站赞同其观点和对其真实性负责。
5、本站一律禁止以任何方式发布或转载任何违法的相关信息,访客发现请向站长举报。
6、本站资源大多存储在云盘,如发现链接失效,请联系我们我们会第一时间更新。

THE END
分享
二维码
< <上一篇
下一篇>>