Python数据分析报告:北京市每月PM2.5的值和分析影响PM2.5

这篇报告基于2010-2014年北京市的PM2.5数据,利用Anaconda环境和Jupyter Notebook进行数据处理。通过去除空值和相关系数矩阵分析,发现露点温度(DEWP)可能对PM2.5有显著影响。使用MinMaxScaler归一化数据后,建立了线性模型、决策树和随机森林模型进行预测。
摘要由CSDN通过智能技术生成

根据北京市2010-2014年的PM2.5数据,预测北京市每月PM2.5的值和分析影响PM2.5的主要因素。

具体的数据如下

数据处理环境:Anaconda(官方网站)就是可以便捷获取包且对包能够进行管理,同时对环境可以统一管理的发行版本。Anaconda包含了conda、Python在内的超过180个科学包及其依赖项。我们选择anaconda环境,在jupyter notebook进行代码编写。
我们导入模块,使用pandas读取数据集

import pandas as pd
import matplotlib.pyplot as plt
import numpy as np
import seaborn a sns
df = pd.read_csv("PRSA_data_2010.1.1-2014.12.31.csv", index_col=0)

之后对数据进行去除空值的操作df = df.dropna()

并绘制绘制相关系数矩阵寻找影响PM2.5的因素

df
评论 3
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

小夕Coding

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值