高调的厂商,比如AWS、谷歌、微软、IBM和Rackspace等,都提供云基础的Hadoop和NoSQL数据库平台来支持大数据应用程序。很多初创公司都引入了云平台上的管理服务,按需部署自己的系统。大数据和云计算的融合往往是互联网公司的首先项,尤其是初创的软件和数据服务供应商。
但很多主流公司并不像互联网公司那样看重云端数据管理。一些公司担心云端的数据安全和隐私保护。一些公司还在大型机和其他本地系统里运行大部分操作。存储在本地的数据量之大,让数据迁移充满挑战。另外,现存数据中心可用的处理能力让AWS和谷歌等公有云的成本优势不值一提,即使公司对于云系统所谓的降低成本、增加弹性有兴趣,最终也未必会选择它。
花旗集团就是一个例子。随着网络成为普及的应用界面,金融服务公司面对的是洪水般的非结构化数据。它还需要处理线上金融应用程序中不同的数据结构。这些挑战让花旗集团最后选择了MongoDB NoSQL数据库。MongoDB获得了AWS和其他云平台的支持。花旗数据公司负责平台工程的全球领导者Michael Simone表示,花旗选择了在云端应用该软件。不过它应用的是私有云,应用限定在纽约公司的防火墙内,由它的IT部门全权管理。
在纽约的MongoDB大会上,Simone告诉与会者:“目前,我们还没有扩展私有云或集成公有云的打算。花旗集团的数据中心很大,技术积累也很深厚,我们可以构建自己的内部部署的云就算。”
大数据云才刚刚开始
总体来看,在云端运行大数据系统仍然是小众行为。在数据仓库研究院开发的大数据