pandas模块随堂笔记(2)

语法:

“”"

lower() 将Series/Index中的字符串转换为小写
upper() 将Series/Index中的字符串转换为大写
len() 计算字符串长度
strip() 帮助从两侧的系列/索引中的每个字符串中删除空格(包括换行符)
split(’ ') 用给定的模式拆分每个字符串
cat(sep=’ ') 使用给定的分隔符连接系列/索引元素
get_dummies() 返回具有单热编码值的数据帧(DataFrame)
contains(pattern) 如果元素中包含子字符串,则返回每个元素的布尔值True,否则为False
replace(a,b) 将值a替换为值b
repeat(value) 重复每个元素指定的次数
count(pattern) 返回模式中每个元素的出现总数
startswith(pattern) 如果系列/索引中的元素以模式开始,则返回true
endswith(pattern) 如果系列/索引中的元素以模式结束,则返回true
find(pattern) 返回模式第一次出现的位置
findall(pattern) 返回模式的所有出现的列表
swapcase() 变换字母大小写
islower() 检查系列/索引中每个字符串中的所有字符是否小写,返回布尔值
isupper() 检查系列/索引中每个字符串中的所有字符是否大写,返回布尔值
isnumeric() 检查系列/索引中每个字符串中的所有字符是否为数字,返回布尔值

“”"

s3=pd.Series([‘大黄,小黄’,‘狗蛋 ‘,’ 铁蛋’,’ 富贵’],index=[‘row1’,‘row2’,‘row3’,‘row4’])
s4=pd.Series([10,10,10,np.NaN],index=[‘row1’,‘row2’,‘row3’,‘row4’])
x1={
‘name’:s3,
‘age’:s4
}
df2=pd.DataFrame(x1)
#print(df2)

count(value)

#print(’—count(value)—’)
#df_name=df2[‘name’]
#print(df_name.str.count(‘黄’))
“”"
—count(value)—
row1 2
row2 0
row3 0
row4 0
Name: name, dtype: int64
“”"

repeat(n)

#print(’----repeat(n)—’)
#df_name=df2[‘name’]
#print(df_name.str.repeat(3))
“”"
----repeat(n)—
row1 大黄,小黄大黄,小黄大黄,小黄
row2 狗蛋 狗蛋 狗蛋
row3 铁蛋 铁蛋 铁蛋
row4 富贵 富贵 富贵
Name: name, dtype: object
“”"

replace()—替换

#print(’—replace()—替换–’)
#df_name=df2[‘name’]
#print(df_name.str.replace(‘富贵’,‘栓柱’))
“”"
—replace()—替换–
row1 大黄,小黄

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
这篇笔记主要介绍了Pandas模块的基本操作和使用方法。PandasPython中一个用于数据分析和处理的常用库,提供了高效的数据结构和数据分析工具,是进行数据处理和数据挖掘的重要工具之一。 一、Pandas数据结构 Pandas主要有两种数据结构:Series和DataFrame。 1. Series Series是一种类似于一维数组的对象,由一组数据和一组与之相关的标签(即索引)组成。Series的创建方式如下: ```python import pandas as pd # 通过列表创建Series s = pd.Series([1, 3, 5, np.nan, 6, 8]) # 通过字典创建Series s = pd.Series({'a': 1, 'b': 2, 'c': 3}) ``` 2. DataFrame DataFrame是一种二维表格数据结构,由一组数据和一组行索引和列索引组成。DataFrame的创建方式有很多种,最常用的是通过字典创建。例如: ```python import pandas as pd data = {'name': ['Tom', 'Jerry', 'Mike'], 'age': [18, 20, 22], 'gender': ['M', 'M', 'F']} df = pd.DataFrame(data) ``` 二、Pandas的基本操作 1. 数据读取 Pandas可以读取多种格式的数据文件,如CSV、Excel、SQL等。常用的读取CSV文件的方式如下: ```python import pandas as pd df = pd.read_csv('data.csv') ``` 2. 数据预处理 数据预处理是数据挖掘中非常重要的一部分,Pandas提供了很多方便的函数和方法来进行数据清洗和转换。常用的数据预处理函数和方法有: - 处理缺失值 ```python # 判断是否存在缺失值 df.isnull() # 删除缺失值 df.dropna() # 填充缺失值 df.fillna(value) ``` - 处理重复值 ```python # 删除重复值 df.drop_duplicates() ``` - 数据转换 ```python # 数据类型转换 df.astype() # 数据替换 df.replace() ``` 3. 数据分析 Pandas提供了各种数据分析和处理的方法和函数,常用的包括: - 统计函数 ```python # 计算平均值 df.mean() # 计算标准差 df.std() # 计算最大值和最小值 df.max(), df.min() ``` - 排序 ```python # 按照某列排序 df.sort_values(by='column_name') ``` - 数据聚合 ```python # 对某列数据进行分组求和 df.groupby('column_name').sum() ``` 以上是Pandas模块的基础内容,还有很多高级用法和技巧需要进一步学习和掌握。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值