码迷,mamicode.com
首页 > 编程语言 > 详细

利用Python进行数据分析(14) pandas基础: 数据转换

时间:2016-08-14 17:49:31      阅读:279      评论:0      收藏:0      [点我收藏+]

标签:


数据转换指的是对数据的过滤、清理以及其他的转换操作。

移除重复数据
DataFrame里经常会出现重复行,DataFrame提供一个duplicated()方法检测各行是否重复,另一个drop_duplicates()方法用于丢弃重复行:
技术分享

duplicated()和drop_duplicates()方法默认判断全部列,如果不想这样,传入列的集合作为参数可以指定按列判断,例如:
技术分享

duplicated()和drop_duplicates()方法默认保留第一个出现的值,传入take_last=True保留最后一个值:
技术分享

利用映射进行数据转换
技术分享

使用函数也能达到同样的效果:
技术分享

替换值
replace()方法用于替换:
技术分享

一次替换多个值:
技术分享

对不同的值进行不同的替换:
技术分享

DataFrame重命名轴索引
重命名列:
技术分享

重命名索引:
技术分享

将数据划分成不同的组:
技术分享

检测和过滤异常值
假设你有一组数据:
技术分享

找出绝对值大于2的值:
技术分享

找出绝对值大于2的行:
技术分享

将异常值设置为0:
技术分享

利用Python进行数据分析(14) pandas基础: 数据转换

标签:

原文地址:http://www.cnblogs.com/sirkevin/p/5767518.html

(0)
(0)
   
举报
评论 一句话评论(0
登录后才能评论!
© 2014 mamicode.com 版权所有  联系我们:gaon5@hotmail.com
迷上了代码!