数据操作之-dataframe常见操作:取行、列、切片、统计特征值

import numpy as np
import pandas as pd
from pandas import  *
from numpy import *


data = DataFrame(np.arange(16).reshape(4,4),index = list("ABCD"),columns=list('wxyz'))
print data
print data[0:2]       #取前两行数据


print len(data )              #求出一共多少行
print data.columns.size      #求出一共多少列


print data.columns        #列索引名称
print data.index       #行索引名称


print data.ix[1]                #取第2行数据
print data.iloc[1]             #取第2行数据


print data['x']      #取列索引为x的一列数据
print data.loc['A']      #取第行索引为”A“的一行数据,


print data.loc[:,['x','z'] ]          #表示选取所有的行以及columns为a,b的列;注意和iloc的区别
print data.loc[['A','B'],['x','z']]     #表示选取'A'和'B'这两行以及columns为x,z的列的并集;


print data.iloc[1:3,1:3]              #数据切片操作,切连续的数据块
print data.iloc[[0,2],[1,2]]              #即可以自由选取行位置,和列位置对应的数据,切零散的数据块


print data[data>2
  • 0
    点赞
  • 9
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
DataFrame对象的分组操作是指根据某个或多个的值将数据拆分成不同的分组,并对每个分组进行独立的操作或分析。在进行数据分析时,常需要对数据进行分组并对每个分组进行统计、计算等操作,以便更好地理解数据的特点和趋势。 DataFrame对象的分组操作通常包括以下步骤: 1. 根据某或某几的值将数据进行分组。可以使用`groupby()`函数指定要进行分组的。 2. 对每个分组进行操作。可以使用各种函数或方法,如计数、求和、平均值、位数、最大值、最小值等,对每个分组进行处理,并得到相应的结果。 3. 合并分组结果。根据具体需求,可以将每个分组的结果进行合并或组合,形成新的DataFrame或Series对象。 分组操作可以提供很多便利,例如: 1. 对数据进行统计分析。通过分组可以获得每个分组的统计指标,如总和、平均值、位数等,从而更好地了解数据特征。 2. 数据切片与筛选。可以根据分组结果,对数据进行切片操作,只关注某个或某几个分组的数据,或者进行条件筛选。 3. 数据的聚合与汇总。通过分组操作可以将数据进行聚合,并得到每个分组的汇总结果,如某个类别下的总和、平均值等。 4. 数据的分组排序。可以根据分组结果进行排序,如根据某个分组的均值进行排序,从而找到具有特定特征的分组。 总之,DataFrame对象的分组操作可以帮助我们更深入地理解数据,进行灵活的数据分析和处理。

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值