机器学习问题分类

机器学习(Machine Learning)问题一般是通过一堆样本(Sample)数据去预测未知的数据。如果这些数据不是一维的,像一些多维的节点(entry),就把它们称为特征(features)。

机器学习问题可以分为两大类:

  • 监督学习(supervised learning),训练数据中包含了我们需要预测的属性。这种问题可以分为:
    • 分类(classification):样本属于两类或者多类,分类器从已经知道类别的数据(labeled data)进行训练,然后去预测未知类别的数据(unlabeled data)。另一种理解,分类就是离散监督学习的一种形式,即给定有限的类别(categories),给定n个样本,为每一个样本标注正确的类别。
    • 回归(regression),回归这个词中文比较不好理解,英文的意思是倒是比较明晰,就是分类的连续版本。如果期望的输出是一组或多组的连续数据。比如通过一条鱼的年龄和体重预测它的长度,即求f,使得length = f(age, weight)。
  • 非监督学习(unspervised learning),训练数据中并不包含目标值。这种问题的目标是发现样本中相似的组,也称为聚类(clustering);或者是计算数据的分布,也称密度估计(density estimation);或者将高维数据映射至低维,比如用于可视化。
训练集与测试集

在机器学习中,一种通用的做法是将数据分为两部分,一部分用于学习,称为训练集(training set),另一部分用于测试,称为测试集(testing set)。

  • 2
    点赞
  • 2
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值