大数据开发必须掌握哪些技术？

最新推荐文章于 2024-04-21 21:30:05 发布

juan333

最新推荐文章于 2024-04-21 21:30:05 发布

阅读量1.7k

点赞数 4

分类专栏： Hadoop 大数据开发程序员文章标签： Hadoop spark 编程语言程序员大数据开发

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/juan333/article/details/103845251

版权

本文为大数据开发初学者提供了一条详细的学习路径，从认识Hadoop开始，涵盖Hadoop的安装、使用与原理，到使用SQL进行更高效的WordCount，再到数据的导入导出、实时计算框架如Spark和Storm，以及任务调度系统Oozie和实时数据处理工具Kafka。文章强调了学习SQL和理解大数据处理框架的重要性，为构建完整的数据平台提供了指导。

摘要由CSDN通过智能技术生成

当学生问到如何学习大数据技术，每次口头介绍都心中清楚无法清晰讲清楚这些技术名词，简单整理给大家。

大数据开发的工具与语言：编程语言（Java，python，R语言等）

1、大数据离线处理架构Hadoop（基于JAVA）开源免费，懂JavaSE；

2、大数据实时计算的架构storm（基于JAVA）开源免费，懂JavaSE；

3、大数据内存计算Spark（基于Scala语言开发）基于JDK开发，本质是Java；

4、大数据下一代计算引擎 Flink。

学习路线：

• Java→ Hadoop→ Storm→Scala→Spark

• NoSQL数据库

Java课程体系可参考下图

大数据开发必须掌握哪些技术？

万字长文，建议收藏

大纲：

第一章：初识Hadoop

第二章：更高效的WordCount

第三章：把别处的数据搞到Hadoop上

第四章：把Hadoop上的数据搞到别处去

第五章：快一点吧，我的SQL

第六章：一夫多妻制

第七章：越来越多的分析任务

第八章：我的数据要实时

第九章：我的数据要对外

第十章：牛逼高大上的机器学习

经常有初学者问我，自己想往大数据方向发展，该学哪些技术，学习路线是什么样的，觉得大数据很火，就业很好，薪资很高。如果自己很迷茫，为了这些原因想往大数据方向发展，也可以，那么我就想问一下，你的专业是什么，对于计算机/软件，你的兴趣是什么？是计算机专业，对操作系统、硬件、网络、服务器感兴趣？是软件专业，对软件开发、编程、写代码感兴趣？还是数学、统计学专业，对数据和数字特别感兴趣。

其实这就是想告诉你的大数据的三个发展方向，平台搭建/优化/运维/监控、大数据开发/设计/架构、数据分析/挖掘。请不要问我哪个容易，哪个前景好，哪个钱多。先扯一下大数据的4V特征：

数据量大，TB->PB
数据类型繁多，结构化、非结构化文本、日志、视频、图片、地理位置等；
商业价值高，但是这种价值需要在海量数据之上，通过数据分析与机器学习更快速的挖掘出来；
处理时效性高，海量数据的处理需求不再局限在离线计算当中。

现如今，正式为了应对大数据的这几个特点，开源的大数据框架越来越多，越来越强，先列举一些常见的：

文件存储：Hadoop HDFS、Tachyon、KFS
离线计算：Hadoop MapReduce、Spark
流式、实时计算：Storm、Spark Streaming、S4、Heron
K-V、NOSQL数据库：HBase、Redis、MongoDB
资源管理：YARN、Mesos
日志收集：Flume、Scribe、Logstash、Kibana
消息系统：Kafka、StormMQ、ZeroMQ、RabbitMQ
查询分析：Hive、Impala、Pig、Presto、Phoenix、SparkSQL、Drill、Flink、Kylin、Druid
分布式协调服务：Zookeeper
集群管理与监控：Ambari、Ganglia、Nagios、Cloudera Manager
数据挖掘、机器学习：Mahout、Spark MLLib
数据同步：Sqoop
任务调度：Oozie
……

眼花了吧，上面的有30多种吧，别说精通了，全部都会使用的，估计也没几个。
就我个人而言，主要经验是在第二个方向（开发/设计/架构），且听听我的建议吧。

第一章：初识Hadoop

1.1 学会百度与Google

不论遇到什么问题，先试试搜索并自己解决。

Google首选，翻不过去的，就用百度吧。

1.2 参考资料首选官方文档

特别是对于入门来说，官方文档永远是首选文档。

相信搞这块的大多是文化人，英文凑合就行，实在看不下去的，请参考第一步。

最低0.47元/天解锁文章

关注

4
点赞
踩
10

收藏

觉得还不错? 一键收藏
0
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

专栏目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。