机器学习的一些笔记

从sklearn开始

机器学习,一定会有分类、聚类算法。分类我是从朴素贝叶斯开始学习的,核心思想很简单,要记住它是一个概率图模型,是生成模型,大家可以在网上查看到一些写的非常好的博客,这里我就不多说了。除了贝叶斯分类,还可以采用线性回归、逻辑回归、决策树、SVM分类。这几个分类的原理大家可以自行查找,通过sklearn包中提供的方法来学习,可以迅速上手,这里我提供一下我学习的源码地址:https://github.com/liuluyeah/MachineLearning

算法怎么用

每一个算法都要用train.csv文件进行训练,然后把test.csv文件丢到训练好的文件中,得到分类结果。
核心就是几行代码:
import pandas as pd
from sklearn.linear_model import LogisticRegression
from sklearn import cross_validation
print("Training the LR model ...")
model = LogisticRegression(random_state=1)
model.fit(X_train, Y)
······
print("Predicting the Competition Data...")
y_test = model.predict_proba(X_test) # Predict the Target, getting the probability.
pred = y_test[:, 1]               
pred_df = pd.DataFrame(data={'Target':pred})
submissions = pd.DataFrame(ID).join(pred_df)  
submissions.to_csv("D:/aselfstudy/ML/Competition_170427/sub.csv", index=False)

数据预处理

数据预处理很重要!!!我现在面临的问题就是正样本太少,负样本太多,负样本是正阳本的39倍,我现在也正在解决,解决之后再来分享。
  • 1
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值