python数据处理实例-Python----数据预处理代码实例

最新推荐文章于 2024-06-21 13:19:16 发布

weixin_37988176

最新推荐文章于 2024-06-21 13:19:16 发布

阅读量2k

点赞数 1

本文提供Python数据预处理的详细步骤，包括导入标准库、读取数据集、处理缺失值、分类数据、划分训练测试集以及特征缩放。通过使用numpy、pandas、sklearn等库，展示如何进行数据预处理，以备后续建模分析。

摘要由CSDN通过智能技术生成

本文实例为大家分享了Python数据预处理的具体代码，供大家参考，具体内容如下

1.导入标准库

import numpy as np

import matplotlib.pyplot as plt

import pandas as pd

2.导入数据集

dataset = pd.read_csv('data (1).csv') # read_csv：读取csv文件

#创建一个包含所有自变量的矩阵，及因变量的向量

#iloc表示选取数据集的某行某列；逗号之前的表示行，之后的表示列；冒号表示选取全部，没有冒号，则表示选取第几列；values表示选取数据集里的数据。

X = dataset.iloc[:, :-1].values # 选取数据，不选取最后一列。

y = dataset.iloc[:, 3].values # 选取数据,选取每行的第3列数据

3.缺失数据

from sklearn.preprocessing import Imputer #进行数据挖掘及数据分析的标准库，Imputer缺失数据的处理

#Imputer中的参数：missing_values 缺失数据，定义怎样辨认确实数据，默认值：nan ;strategy 策略，补缺值方式： mean-平均值， median-中值， most_frequent-出现次数最多的数； axis =0取列 =1取行

imputer = Imputer(missing_values = 'NaN', strategy = 'mean', axis = 0)

im

最低0.47元/天解锁文章

weixin_37988176

关注

1
点赞
踩
32

收藏

觉得还不错? 一键收藏
0
评论
python数据处理实例-Python----数据预处理代码实例

本文实例为大家分享了Python数据预处理的具体代码，供大家参考，具体内容如下1.导入标准库import numpy as npimport matplotlib.pyplot as pltimport pandas as pd2.导入数据集dataset = pd.read_csv('data (1).csv') # read_csv：读取csv文件#创建一个包含所有自变量的矩阵，及因变量的向量...
复制链接

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。