判断电离层是否存在自由电子

这篇博客介绍了如何利用Python处理电离层数据集,包括数据预处理、使用KNN算法进行训练和预测,以及参数调整。目标是判断数据中是否存在由自由电子构成的特殊结构,最终达到自动分类的效果。
摘要由CSDN通过智能技术生成

数据集介绍

用到的数据集叫作电离层(Ionosphere),这些数据是由高频天线收集的。这些天线的目 的是侦测在电离层和高层大气中存不存在由自由电子组成的特殊结构。如果一条数据能给出特殊 结构存在的证据,这条数据就属于好的那一类(在数据集中用“g”表示),否则就是坏的(用“b” 表示)。我们要做的就是建立分类器,自动判断这些数据的好坏。

这个数据可以从http://archive.ics.uci.edu/ml/datasets/Ionosphere中的Datafolder中下载,下载 ionosphere.data 和 ionosphere.names

该数据集每行有35个值,前34个为17座天线采集的数据(每座天线采集两个数据)。后一 个值不是“g”就是“b”,表示数据的好坏,即是否提供了有价值的信息。


数据预处理

import os
#  #把path中包含的"~"和"~user"转换成用户目录
home_folder = os.path.expanduser("~")
print(home_folder)

通过这种方式就可以很快的定位到用户目录了。输出结果是:
C:\Users\mi

加载数据集前,用Data文件夹路径、数据集所在的文件夹名称和数据集名称组合成数据集文件的完整路径。

# Change this to the location of your dataset

# os.path.join(path1[, path2[, ...]])把目录和文件名合成一个路径
data_folder = os.path.join(home_folder, "Data", "Ionosphere")
data_filename = os.path.join(data_folder, "ionosphere.data")
print(data_folder)
print(data_filename)

输出结果是:
C:\Users\mi\Data\Ionosphere
C

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

Einstellung

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值