下面给大家介绍下pandas读取CSV文件时查看修改各列的数据类型格式,具体内容如下所述:
我们在调bug的时候会经常查看、修改pandas列数据的数据类型,今天就总结一下:
1.查看:
Numpy和Pandas的查看方式略有不同,一个是dtype,一个是dtypes
print(Array.dtype)
#输出int64
print(df.dtypes)
#输出Df下所有列的数据格式 a:int64,b:int64
2.修改
import pandas as pd
import numpy as np
df = pd.read_csv('000917.csv',encoding='gbk')
df = df[df['涨跌幅']!='None']
df['涨跌幅'] = df['涨跌幅'].astype(np.float64)
print(df[df['涨跌幅']>5])
ps:在Pandas中更改列的数据类型
先看一个非常简单的例子:
a = [['a', '1.2', '4.2'], ['b', '70', '0.03'], ['x', '5', '0']]
df = pd.DataFrame(a)
有什么方法可以将列转换为适当的类型