文章详情

短信预约-IT技能 免费直播动态提醒

请输入下面的图形验证码

提交验证

短信预约提醒成功

总结了Pandas实现数据清洗的7种方式

2024-12-03 05:41

关注

1.处理数据中的空值

我们在处理真实的数据时,往往会有很多缺少的的特征数据,就是所谓的空值,必须要进行处理才能进行下一步分析

空值的处理方式有很多种,一般是删除或者填充

Excel通过“查找和替换”功能实现空值的统一替换:

通过“定位”删除空值:

pandas处理空值的方式比较灵活,可以使用dropna函数删除空值

  1. import pandas as pd 
  2. data=pd.read_csv('成绩表.csv',encoding='gbk'
  3. data.dropna(how='any'

用fillna函数实现空值的填充

①使用数字0填充数据表中的空值

  1. data.fillna(value=0)   

②使用平均值填充数据表中的空值

  1. data['语文'].fillna(data['语文'].mean()) 

2.删除空格

excel中清理空格很简单,直接替换即可

pandas删除空格也很方便,主要使用map函数

  1. data['姓名']=data['姓名'].map(str.strip) 
  2. data 

3.大小写转换

excel中大小写转换函数分别为upper()和lower()

pandas中转换函数也为upper()和lower()

  1. data['拼音']=data['拼音'].str.upper() 
  2. data 

  1. data['拼音']=data['拼音'].str.lower() 
  2. data 

4.更改数据格式

excel中更改数据格式通过快捷键“ctrl+1”打开“设置单元格格式”:

pandas使用astype来修改数据格式,以将“语文”列改成整数为例

  1. data['语文'].dropna(how='any').astype('int'

5.更改列名称

excel中更改列名称就不说了,大家都会

pandas使用rename函数更改列名称,代码如下:

  1. data.rename(columns={'语文':'语文成绩'}) 

6.删除重复值

excel的功能区“数据”下有“删除重复项”,可以用来删除表中的重复值,默认保留最第一个重复值,把后面的删除:

pandas使用drop_duplicates函数删除重复值:

  1. data['数学'].drop_duplicates() #默认删除后面的重复值 
  2.  
  3. data['数学'].drop_duplicates(keep='last') #删除第一项重复值 

7.修改及替换数据

excel中使用“查找和替换”功能实现数值的替换

pandas中使用replace函数实现数据替换

  1. data['姓名'].replace('成  功','失  败'

 本文转载自微信公众号「python数据分析之禅」,可以通过以下二维码关注。转载本文请联系python数据分析之禅公众号。

 

来源:python数据分析之禅内容投诉

免责声明:

① 本站未注明“稿件来源”的信息均来自网络整理。其文字、图片和音视频稿件的所属权归原作者所有。本站收集整理出于非商业性的教育和科研之目的,并不意味着本站赞同其观点或证实其内容的真实性。仅作为临时的测试数据,供内部测试之用。本站并未授权任何人以任何方式主动获取本站任何信息。

② 本站未注明“稿件来源”的临时测试数据将在测试完成后最终做删除处理。有问题或投稿请发送至: 邮箱/279061341@qq.com QQ/279061341

软考中级精品资料免费领

  • 历年真题答案解析
  • 备考技巧名师总结
  • 高频考点精准押题
  • 2024年上半年信息系统项目管理师第二批次真题及答案解析(完整版)

    难度     813人已做
    查看
  • 【考后总结】2024年5月26日信息系统项目管理师第2批次考情分析

    难度     354人已做
    查看
  • 【考后总结】2024年5月25日信息系统项目管理师第1批次考情分析

    难度     318人已做
    查看
  • 2024年上半年软考高项第一、二批次真题考点汇总(完整版)

    难度     435人已做
    查看
  • 2024年上半年系统架构设计师考试综合知识真题

    难度     224人已做
    查看

相关文章

发现更多好内容

猜你喜欢

AI推送时光机
位置:首页-资讯-后端开发
咦!没有更多了?去看看其它编程学习网 内容吧
首页课程
资料下载
问答资讯