如何基于Go搭建一个大数据平台

本文介绍了如何使用Go语言构建大数据平台,重点讲解了七牛云的大数据产品Pandora,包括其工作流、系统架构和面临的技术挑战。文章讨论了Export Service模块的设计和优化,如高吞吐、低延迟的实现,以及对多种下游数据的适配。此外,还分享了系统监控、自动化运维和资源管理策略,展示了Go语言在大数据领域应用的优势。
摘要由CSDN通过智能技术生成

大家下午好!我是来自七牛云大数据团队的党合萱。今天向大家介绍一下我们是如何基于Go搭建大数据平台的。


七牛的大数据的产品——Pandora


首先介绍一下七牛的大数据的产品——Pandora,我们的目的是提供简单、高效和开放的大数据平台。图 1 是我们的工作流,提供实时计算和离线计算。我们的数据流实时进来之后可以到下游的实时数据服务,最常见的场景是提供日志搜索和机器性能监控,就是看到的仪表盘(图2),还有就是基于 spark 做一些实时数据分析。

 

图1


图 2


图 3

图 4 是整个Pandora业务上的架构图。数据打进系统之后先落地到消息队列,落地之后有一个计算任务,数据经过计算之后还可以再次落地到消息队列。这个过程很灵活,比如可以选择最左边的一条线把数据直接倒出到下游的系统,图1上的示例是一个HTTP导出,除此之外还可以导出到实时数据库、日志检索服务,或者到七牛云存储上。日志检索服务上可以生成图3的柱状图,时序数据库可以生成上面的仪表盘分析(图 2)。


图 4


系统设计分析和架构


今天要和大家分享的是其中的一个环节——从消息队列导出数据到下游系统,即图 4 中的 Export Service 模块。这是一个连接上下游,有承上启下功能的系统,在实现过程中我们遇到了很多挑战。接下来,我们将从最初的设计开始,来看一下中间有哪些具体的挑战。

图 5

最开始做这

  • 2
    点赞
  • 9
    收藏
    觉得还不错? 一键收藏
  • 1
    评论
评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值