本次内容结合大数据行业技术栈现状,为大家讲解企业中常用的离线分析。从如何使用大数据管理平台Cloudera Manager,到主流常用的分析模型,由浅入深逐步介绍,零基础小白也能看懂。
一、大数据管理平台Cloudera Manager
大数据的生态圈
Cloudera Manager
Cloudera Manager(简称CM)是Cloudera公司开发的一款大数据集群安装部署利器.
这款利器具有集群自动化安装、中心化管理、集群监控、报警等功能,使得安装集群从几天的时间缩短在几小时以内,运维人员从数十人降低到几人以内,极大的提高集群管理的效率。
cloudera manager有四大功能:
(1)管理:对集群进行管理,如添加、删除节点等操作。
(2)监控:监控集群的健康情况,对设置的各种指标和系统运行情况进行全面监控。
(3)诊断:对集群出现的问题进行诊断,对出现的问题给出建议解决方案。
(4)集成:对hadoop的多组件进行整合。