笔记
shawnlyrui
这个作者很懒,什么都没留下…
展开
-
逻辑回归算法梳理
1.逻辑回归与线性回归的联系与区别线性回归是机器学习中最简单的回归算法,它可以写为一个熟悉的表达式:z=θ0+θ1+...+θnxnz=\theta_0+\theta_1+...+\theta_n x_nz=θ0+θ1+...+θnxnθ\thetaθ被称为为模型的参数,其中θ0\theta_0θ0被称为截距,θ1∽θn\theta_1{\backsim}\theta_nθ1∽θ...原创 2019-05-14 17:14:48 · 140 阅读 · 0 评论 -
学习笔记_o1
机器学习的一些概念:1.基本术语:有监督学习: 从给定的训练数据集中学习出一个函数(模型参数),当新的数据到来时,可以根据这个函数预测结果。监督学习的训练集要求包括输入输出,也可以说是特征和目标。训练集中的目标是由人标注的。监督学习就是最常见的分类(注意和聚类区分)问题,通过已有的训练样本(即已知数据及其对应的输出)去训练得到一个最优模型(这个模型属于某个函数的集合,最优表示某个评价准则...原创 2019-05-12 21:16:17 · 144 阅读 · 0 评论 -
文件太大如何读取
1.读一小部分df_2 = pd.read_csv('data/JData_Action_201602.csv',nrows=10000, encoding = 'gbk')2.一小部分遍历def get_data(fname,chunk_size = 50000): reader = pd.read_csv(fname,header = 0,iterator = True, ...原创 2019-05-26 13:02:23 · 833 阅读 · 0 评论 -
数据可视化小节
可视化小节_01pandas自带的可视化工具:plot工具:产生数据data = pd.DataFrame(np.random.rand(30,2)*1000,columns = [‘A_scale’,‘B_scale’],index = pd.period_range(‘20170601’,‘20170630’))data.head()1.1 快速出图data.plot()...原创 2019-05-13 15:03:58 · 258 阅读 · 0 评论 -
s3_决策树算法梳理
import numpy from sklearn import treefrom sklearn.datasets import load_winefrom sklearn.model_selection import train_test_splitwine = load_wine()wine.data # 特征wine.target # 标签import pan...翻译 2019-05-18 18:54:58 · 252 阅读 · 0 评论