海量数据处理专题(一、二、三)

 大数据量的问题是很多面试笔试中经常出现的问题,比如 baidu google  腾讯   这样的一些涉及到海量数据的公司经常会问到。  

   

    下面的方法是我对海量数据的处理方法进行了一个一般性的总结,当然这些方法可能并不能完全覆盖所有的问题,但是这样的一些方法也基本可以处理绝大多数遇到的问题。下面的一些问题基本直接来源于公司的面试笔试题目,方法不一定最优,如果你有更好的处理方法,欢迎与我讨论。 

   

    本贴从解决这类问题的方法入手,开辟一系列专题来解决海量数据问题。拟包含
以下几个方面。1.  Bloom Filter  2.  Hash  3.  Bit-Map  4.  (Heap)  5.  双层桶划分  6.  数据库索引  7.  排索引(Inverted Index  8.   外排序  9.   Trie树  10. MapReduce 

 

文章放在我的 百度空间 档案收藏里面,有空再补上。
  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值