白话各种机器学习算法的特点及适用场景「ML」「AI核心算法」

最新推荐文章于 2024-08-06 11:30:30 发布

九三智能控v

最新推荐文章于 2024-08-06 11:30:30 发布

阅读量1.1k

点赞数

文章标签：算法决策树神经网络大数据 python

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/u9Oo9xkM169LeLDR84/article/details/110358538

版权

本文详述了多种机器学习算法的特点和应用场景，包括近邻、贝叶斯、决策树、随机森林、SVM、神经网络等。随机森林在许多数据集上表现出色，而SVM具有高准确性和抗攻击性。神经网络在大数据情况下效果良好。随机森林和SVM是常用选择，而决策树和提升算法适合初学者。

摘要由CSDN通过智能技术生成

关注：决策智能与机器学习，深耕AI脱水干货

作者：xyzh 来源：知乎

原文地址：https://www.zhihu.com/question/26726794/answer/151282052

转载请联系作者

精炼的说：

没有最好的分类器，只有最合适的分类器。

随机森林平均来说最强，但也只在9.9%的数据集上拿到了第一，优点是鲜有短板。

SVM的平均水平紧随其后，在10.7%的数据集上拿到第一。

神经网络（13.2%）和boosting（~9%）表现不错。

数据维度越高，随机森林就比AdaBoost强越多，但是整体不及SVM[2]。

数据量越大，神经网络就越强。

正好14年的时候有人做过一个实验[1]，比较在不同数据集上（121个），不同的分类器（179个）的实际效果。

论文题为：Do we Need Hundreds of Classifiers to Solve Real World Classification Problems?

实验时间有点早，我尝试着结合我自己的理解、一些最近的实验，来谈一谈吧。主要针对分类器(Classifier)。

近邻 (Nearest Neighbor)

典型的例子是KNN，它的思路就是——对于待判断的点，找到离它最近的几个数据点，根据它们的类型决定待判断点的类型。

它的特点是完全跟着数据走，没有数学模型可言。

适用情景：

需要一个特别容易解释的模型的时候。

比如需要向用户解释原因的推荐算法。

贝叶斯 (Bayesian)

典型的例子是Naive Bayes，核心思路是根据条件概率计算待判断点的类型。

是相对容易理解的一个模型，至今依然被垃圾邮件过滤器使用。

适用情景：

需要一个比较容易解释，而且不同维度之间相关性较小的模型的时候。

可以高效处理高维数据，虽然结果可能不尽如人意。

决策树 (Decision tree)

决策树的特点是它总是在沿着特征做切分。随着层层递进，这个划分会越来越细。

虽然生成的树不容易给用户看，但是数据分析的时候，通过观察树的上层结构，能够对分类器的核心思路有一个直观的感受。

最低0.47元/天解锁文章

九三智能控v

关注

0
点赞
踩
3

收藏

觉得还不错? 一键收藏
0
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。