【Datawhale AI 夏令营2024】体验 baseline

最新推荐文章于 2024-07-28 15:46:11 发布

上班社畜

最新推荐文章于 2024-07-28 15:46:11 发布

阅读量324

点赞数 3

分类专栏：【Datawhale AI 夏令营2024】文章标签： python 笔记

本文链接：https://blog.csdn.net/2302_80953191/article/details/140406101

版权

【Datawhale AI 夏令营2024】专栏收录该内容

4 篇文章 0 订阅

订阅专栏

【Datawhale AI 夏令营2024】体验 baseline

task 01

赛题任务

给定多个房屋对应电力消耗历史N天的相关序列数据等信息，预测房屋对应电力的消耗。

baseline 代码

import pandas as pd
import numpy as np

train = pd.read_csv('./data/data283931/train.csv')
test = pd.read_csv('./data/data283931/test.csv')

target_mean = train[train['dt']<=20].groupby(['id'])['target'].mean().reset_index()

test = test.merge(target_mean, on=['id'], how='left')

test[['id','dt','target']].to_csv('submit.csv', index=None)

1、

import pandas as pd
import numpy as np

导入 pandas 库，用于数据处理和分析
导入 numpy 库，用于科学计算和多维数组操作

2、

train = pd.read_csv(‘./data/data283931/train.csv’)
test = pd.read_csv(‘./data/data283931/test.csv’)

使用 read_csv() 函数从文件中读取测试集数据，文件名为 ‘train.csv’

3、

target_mean = train[train[‘dt’]<=20].groupby([‘id’])[‘target’].mean().reset_index()

计算训练数据最近11-20单位时间内对应id的目标均值

4、

test = test.merge(target_mean, on=[‘id’], how=‘left’)

将target_mean作为测试集结果进行合并

5、

test[[‘id’,‘dt’,‘target’]].to_csv(‘submit.csv’, index=None)

保存结果文件到本地

参考

读取数据：代码通过使用 pd.read_csv 函数从文件中读取训练集和测试集数据，并将其存储在 train.csv 和 test.csv 两个数据框中。
将用电均值直接作为预测结果：
这里使用merge函数根据’id’列将test和target_mean两个DataFrame进行左连接，这意味着测试集的所有行都会保留。
保存结果文件到本地：
使用to_csv()函数将测试集的’id’、‘dt’和’target’列保存为CSV文件，文件名为’submit.csv’。index=None参数表示在保存时不包含行索引。