华为fusionsphere整体架构及其各组件功能_入门大数据必学的11个组件，大数据，比你更了解你自己...

最新推荐文章于 2024-02-27 11:08:04 发布

weixin_39715187

最新推荐文章于 2024-02-27 11:08:04 发布

阅读量1k

点赞数

文章标签：华为fusionsphere整体架构及其各组件功能

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/weixin_39715187/article/details/111343982

版权

掌握技能

1.系统掌握常用且重要的大数据组件技术原理与架构；

2.运用华为大数据解决方案FusionInsight HD进行海量数据的导入和导出；

3.具备开源Hadoop生态系统进行数据初步处理的能力；

4.掌握分布式数据库HBase客户端及表操作；

5.熟悉分布式数据仓库Hive的常用HQL语句查询。

大数据新手学习交流群，如果有想学习大数据或者交流经验的都可以加入，一起互相学习交流：→→→点击我即可加入圈子

课程内容

1、初识大数据

内容提要：了解大数据的定义与特点，以及大数据在不同行业的应用。

2、HDFS分布式文件系统

内容提要：学习开源Hadoop基础框架，掌握NameNode、DataNode和Client三大组成部分。

3、MapReduce批处理

内容提要：讲解MapReduce和Yarn的基本概念，重点学习Yarn的关键流程、资源管理和特性。

4、Spark2X分布式计算

内容提要：一个核心三个引擎。Spark Core是Spark的核心组件，Spark SQL处理结构化数据引擎，Spark Streaming微批处理的流处理引擎以及构建在Spark SQL引擎上的流数据处理引擎Structured Streaming。

5、HBase分布式数据库

内容提要：介绍HBase的功能与架构，学习HBase如何使用memstore和storefile存储对表的更新数据。

6、Hive分布式数据仓库

内容提要：学习Hive的数据存储方式、实现原理以及使用的语法，关键知识：Colocation。

7、Streaming流处理引擎

内容提要：不同于MapReduce，Streaming是实时计算，要求毫秒级的响应时间，又该如何保障消息的可靠性

8、Flink流计算处理和批处理平台

内容提要：掌握Flink的底层原理和技术框架，以及checkpoint机制如何实现容错，允许系统提供高并发并在同一时间提供强一致性保证。

9、Loader数据转换

内容提要：分析数据路径，用于描述数据如何从数据源经过抽取、转换和加载至目的端全过程。

10、Flume海量日志聚合

内容提要：理论与实践结合，不仅学习Flume的基本知识点，还通过操作实例演示配置安装，完成对Flume采集流程配置。

11、Kafka分布式消息订阅系统

内容提要：介绍Producer、Broker、Consumer和ZooKeeper在Kafka集群中的架构，以实现其高吞吐、分布式、基于发布订阅的消息功能。

12、ZooKeeper集群

内容提要：了解ZooKeeper的作用、服务架构、数据模型以及与其他各组件中间的关系。

13、FusionInsight HD解决方案

内容提要：分享华为企业级大数据解决方案，FusionInsight HD的4个子产品以及1个操作运维系统。

14、结课测试

内容提要：对学习结果进行测验，查验自己的不足之处，重新温习直至完全掌握知识点。

码字不容易,帮忙点个赞,点赞关注是我写作的动力，谢谢

weixin_39715187

关注

0
点赞
踩
2

收藏

觉得还不错? 一键收藏
0
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。