电力需求预测挑战赛
赛题任务
给定多个房屋对应电力消耗历史N天的相关序列数据等信息,预测房屋对应电力的消耗。
赛题数据简介
赛题数据由训练集和测试集组成,为了保证比赛的公平性,将每日日期进行脱敏,用1-N进行标识。
即1为数据集最近一天,其中1-10为测试集数据。
数据集由字段id(房屋id)、 dt(日标识)、type(房屋类型)、target(实际电力消耗)组成。
baseline代码
# 导入需要用到的相关库
import pandas as pd # 用于数据处理和分析
import numpy as np # 用于科学计算和多维数组操作
# 读取训练集和测试集
train = pd.read_csv('./data/data283931/train.csv')# 使用read_csv() 函数从文件中读取训练集数据
test = pd.read_csv('./data/data283931/test.csv')# 使用read_csv() 函数从文件中读取测试集数据
# 计算训练数据最近11-20单位时间内对应id的目标均值
target_mean = train[train['dt']<=20].groupby(['id'])['target'].mean().reset_index()
# 将target_mean作为测试集结果进行合并
test = test.merge(target_mean, on=['id'], how='left')
# 保存结果文件到本地
test[['id','dt','target']].to_csv('submit.csv', index=None)
参考内容
从零入门机器学习竞赛