Machine Learning Chapter 1:绪论


1.基本术语

  • 数据集 (data set):记录的合集即为数据集,每条记录是关于一个事件或对象的描述,称为一个示例instance或样本sample。
  • 属性 (attribute):事件或对象的某个特征eg:色泽
  • 样本空间 (sample space):由属性张成的空间eg:{色泽,根蒂,敲声}为一个三维样本空间
  • 特征向量 (feature vector):样本空间中的一个点对应的坐标向量,即一个样本or记录就是一个特征向量,eg:(色泽=青绿;根蒂=蜷缩;敲声=浊响)为一个特征向量
  • 学习or训练:从数据集中学得模型的过程。

Coming Soon:


监督学习Supervised:训练前已知正确答案
分类 (classify) :
决策树(decision-making tree),支持向量机(SVM)…
回归 (regression) :
最小二乘法(Ordinary Least Square),逻辑回归(Logistic Regression)…


无监督学习Unsupervised:训练前不知道正确答案
聚类 (clustering):
K-means…

  • 泛化能力 (generalization):算法or模型对新样本的识别能力从英文generalization来看,就是指模型的普适性。

2.假设空间

除了归纳and演绎,有点没看懂,日后补坑…

3.归纳偏好

Promble:
同一个数据集训练出不同模型,选哪个?哪个模型更好?

Principle:
奥卡姆剃须刀原则 (选其中最简单的模型)

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值