GItHub：【大数据实战项目】汇总

最新推荐文章于 2024-06-22 14:42:03 发布

Haven.Liu

最新推荐文章于 2024-06-22 14:42:03 发布

阅读量5k

点赞数 2

分类专栏：大数据开源项目文章标签： GitHub 大数据项目

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/LiuKingJia/article/details/103403584

版权

大数据同时被 2 个专栏收录

12 篇文章 1 订阅

订阅专栏

2 篇文章 0 订阅

订阅专栏

一、Spark

1、《Spark 大型电商项目实战》

* 用户访问session分析

* 页面单跳转化率统计

* 热门商品离线统计

博客地址：http://blog.csdn.net/u012318074/article/category/6744423

GitHub地址：https://github.com/Erik-ly/SprakProject

2、基于spark streaming和kafka，hbase的日志统计分析系统

https://github.com/wankunde/logcount

Kafka：作为日志事件的消息系统，具有分布式，可分区，可冗余的消息服务功能。
Spark：使用spark stream功能，实时分析消息系统中的数据，完成计算分析工作。
Hbase：做为后端存储，存储spark计算结构，供其他系统进行调用

3、日志分析统计

Spark Streaming+Flume+Kafka+HBase+Hadoop+Zookeeper实现实时；SpringBoot+Echarts实现数据可视化展示

https://github.com/ljcan/SparkStreaming

二、Flink

1、基于Flink实现的商品实时推荐系统。flink统计商品热度，放入redis缓存，分析日志信息，将画像标签和实时记录放入Hbase。在用户发起推荐请求后，根据用户画像重排序热度榜，并结合协同过滤和标签两个推荐模块为新生成的榜单的每一个产品添加关联产品，最后返回新的用户列表。
GitHub：https://github.com/CheckChe0803/flink-recommandSystem-demo

2、基于Flink对用户行为数据的实时分析
https://github.com/Tiankx1003/Data-Warehouse-Flink

三、PySpark

drabastomek/learningPySpark
https://github.com/drabastomek/learningPySpark

(

大数据入门与实战-PySpark的使用教程
https://www.jianshu.com/p/5a42fe0eed4d

第1天：PySpark简介及环境搭建
https://www.missshi.cn/api/view/blog/5cd03277cb99636e72000001

)

四、大数据优质博客

1、大数据施工现场

https://blog.sev7e0.site/

关注

2
点赞
踩
95

收藏

觉得还不错? 一键收藏
0
评论
GItHub：【大数据实战项目】汇总

一、Spark1、《Spark 大型电商项目实战》* 用户访问session分析* 页面单跳转化率统计* 热门商品离线统计博客地址：http://blog.csdn.net/u012318074/article/category/6744423GitHub地址：https://github.com/Erik-ly/SprakProject2、基于spark stream...
复制链接

扫一扫

专栏目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。