技术分享:基于HBase和Spark构建企业级数据处理平台

基于HBase和Spark构建企业级数据处理平台,面临的场景:金融风控;个性化推荐;社交Feeds;时空时序以及大数据等。作者:大数据与机器学习

技术分享:基于HBase和Spark构建企业级数据处理平台

 

面临的场景

金融风控

  • 用户画像库
  • 爬虫抓取信息
  • 反欺诈系统
  • 订单数据

个性化推荐

  • 用户行为分析
  • 用户画像
  • 推荐引擎
  • 海量实时数据处理

社交Feeds

  • 海量帖子、文章
  • 聊天、评论
  • 海量实时数据处理

时空时序

  • 监控数据
  • 轨迹、设备数据
  • 地理信息
  • 区域分布统计
  • 区域查询

大数据

  • 维表和结果表
  • 离线分析
  • 海量实时数据存储

新的挑战

Apache HBase(在线查询) 的特点有:

  • 松散表结构(Schema free)
  • 随机查询、范围查询
  • 原生海量数据分布式存储
  • 高吞吐、低延迟
  • 在线分布式数据库
  • 多版本、增量导入、多维删除

面临

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值