自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+

笔记

机器学习笔记

  • 博客(5)
  • 收藏
  • 关注

原创 文件太大如何读取

1.读一小部分 df_2 = pd.read_csv('data/JData_Action_201602.csv',nrows=10000, encoding = 'gbk') 2.一小部分遍历 def get_data(fname,chunk_size = 50000): reader = pd.read_csv(fname,header = 0,iterator = True, ...

2019-05-26 13:02:23 822

翻译 s3_决策树算法梳理

import numpy from sklearn import tree from sklearn.datasets import load_wine from sklearn.model_selection import train_test_split wine = load_wine() wine.data # 特征 wine.target # 标签 import pan...

2019-05-18 18:54:58 248

原创 逻辑回归算法梳理

1.逻辑回归与线性回归的联系与区别 线性回归是机器学习中最简单的回归算法,它可以写为一个熟悉的表达式: z=θ0+θ1+...+θnxnz=\theta_0+\theta_1+...+\theta_n x_nz=θ0​+θ1​+...+θn​xn​ θ\thetaθ被称为为模型的参数,其中θ0\theta_0θ0​被称为截距,θ1∽θn\theta_1{\backsim}\theta_nθ1​∽θ...

2019-05-14 17:14:48 133

原创 数据可视化小节

可视化小节_01 pandas自带的可视化工具: plot工具: 产生数据 data = pd.DataFrame(np.random.rand(30,2)*1000, columns = [‘A_scale’,‘B_scale’], index = pd.period_range(‘20170601’,‘20170630’)) data.head() 1.1 快速出图 data.plot()...

2019-05-13 15:03:58 244

原创 学习笔记_o1

机器学习的一些概念: 1.基本术语: 有监督学习: 从给定的训练数据集中学习出一个函数(模型参数),当新的数据到来时,可以根据这个函数预测结果。监督学习的训练集要求包括输入输出,也可以说是特征和目标。训练集中的目标是由人标注的。监督学习就是最常见的分类(注意和聚类区分)问题,通过已有的训练样本(即已知数据及其对应的输出)去训练得到一个最优模型(这个模型属于某个函数的集合,最优表示某个评价准则...

2019-05-12 21:16:17 139

空空如也

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除