大数据初认识

大数据初认识

机器学习和数据挖掘的区别

机器学习是以探索机器学习人的学习机制为目标的

数据挖掘是试图从海量数据中找出有用的知识。

机器学习的科学成分更重一些,而数据挖掘的技术成分更重一些。

大数据处理系统的分类

就目前而言,主要的大数据处理系统有批处理系统、流计算系统、迭代计算系统、图计算系统和查询分析计算系统。

批处理系统其代表产品是MapReduce、Spark、Hadoop

流计算系统其代表产品是Storm

迭代计算系统其代表产品是Hadoop、、Twister、MapReduce、Spark(其中Hadoop基于磁盘,Spark基于内存)

图计算系统其代表产品是GraphX

查询分析计算系统其代表产品是Hive、HBase(分布式数据库)

大数据处理的基本流程

首先是数据收集,源数据其中有RDBMS(结构化数据)、HTML(半结构化数据)、文档数据(非结构化数据),然后将数据进行“清洗”,数据抽取和数据集成,也就是将数据处理一下,使得数据明朗,再将数据通过机器学习和数据挖掘数据统计技术去分析,数据加工处理好了,就要可视化展现出来,也就是数据解释,最后将其发送至用户

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
经导师精心指导并认可、获 98 分的毕业设计项目!【项目资源】:微信小程序。【项目说明】:聚焦计算机相关专业毕设及实战操练,可作课程设计与期末大作业,含全部源码,能直用于毕设,经严格调试,运行有保障!【项目服务】:有任何使用上的问题,欢迎随时与博主沟通,博主会及时解答。 经导师精心指导并认可、获 98 分的毕业设计项目!【项目资源】:微信小程序。【项目说明】:聚焦计算机相关专业毕设及实战操练,可作课程设计与期末大作业,含全部源码,能直用于毕设,经严格调试,运行有保障!【项目服务】:有任何使用上的问题,欢迎随时与博主沟通,博主会及时解答。 经导师精心指导并认可、获 98 分的毕业设计项目!【项目资源】:微信小程序。【项目说明】:聚焦计算机相关专业毕设及实战操练,可作课程设计与期末大作业,含全部源码,能直用于毕设,经严格调试,运行有保障!【项目服务】:有任何使用上的问题,欢迎随时与博主沟通,博主会及时解答。 经导师精心指导并认可、获 98 分的毕业设计项目!【项目资源】:微信小程序。【项目说明】:聚焦计算机相关专业毕设及实战操练,可作课程设计与期末大作业,含全部源码,能直用于毕设,经严格调试,运行有保障!【项目服务】:有任何使用上的问题,欢迎随时与博主沟通,博主会及时解答。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值