1、 NoSQL简介
1.1 什么是NoSQL?
NoSQL,指的是非关系型的数据库。NoSQL有时也称作Not Only SQL的缩写,是对不同于传统的关系型数据库的数据库管理系统的统称。
NoSQL用于超大规模数据的存储。(例如谷歌或Facebook每天为他们的用户收集万亿比特的数据)。这些类型的数据存储不需要固定的模式,无需多余操作就可以横向扩展。
1.2 为什么使用NoSQL ?
今天我们可以通过第三方平台(如:Google,Facebook等)可以很容易的访问和抓取数据。用户的个人信息,社交网络,地理位置,用户生成的数据和用户操作日志已经成倍的增加。我们如果要对这些用户数据进行挖掘,那SQL数据库已经不适合这些应用了, NoSQL 数据库的发展却能很好的处理这些大的数据。
1.3 NoSQL的优点/缺点
1.3.1 优点:
- 高可扩展性
- 分布式计算
- 低成本
- 架构的灵活性,半结构化数据
- 没有复杂的关系
1.3.2 缺点:
- 没有标准化
- 有限的查询功能(到目前为止)
- 最终一致是不直观的程序
1.4 NoSQL 数据库分类
类型 | 典型 | 特点 |
---|---|---|
列存储 | Hbase Cassandra Hypertable | 按列存储数据,方便存储结构化和半结构化数据,方便做数据压缩,对针对某一列或者某几列的查询有非常大的IO优势。 |
文档存储 | Hbase Cassandra Hypertable | 文档存储一般用类似json的格式存储,存储的内容是文档型的。这样也就有机会对某些字段建立索引,实现关系数据库的某些功能。 |
key-value存储 | Redis Memcache | 可以通过key快速查询到其value。 |
图存储 | Neo4J FlockDB | 图形关系的最佳存储。使用传统关系数据库来解决的话性能低下,而且设计使用不方便。 |
对象存储 | db4o Versant | 通过类似面向对象语言的语法操作数据库,通过对象的方式存取数据。 |
xml数据库 | Berkeley DB BaseX | 高效的存储XML数据,并支持XML的内部查询语法,比如XQuery,Xpath。 |
1.5 CAP定理(CAP theorem)
在计算机科学中, CAP定理(CAP theorem), 又被称作 布鲁尔定理(Brewer’s theorem), 它指出对于一个分布式计算系统来说,不可能同时满足以下三点:
- 一致性(Consistency) (所有节点在同一时间具有相同的数据)
- 可用性(Availability) (保证每个请求不管成功或者失败都有响应)
- 分区容错(Partition tolerance) (系统中任意信息的丢失或失败不会影响系统的继续运作)
CAP理论的核心是:一个分布式系统不可能同时很好的满足一致性,可用性和分区容错性这三个需求,最多只能同时较好的满足两个。因此,根据 CAP 原理将 NoSQL 数据库分成了满足 CA 原则、满足 CP 原则和满足 AP 原则三 大类:
- CA - 单点集群,满足一致性,可用性的系统,通常在可扩展性上不太强大。
- CP - 满足一致性,分区容忍性的系统,通常性能不是特别高。
- AP - 满足可用性,分区容忍性的系统,通常可能对一致性要求低一些。
2、 mongodb 简介
2.1 什么是MongoDB
MongoDB是一个基于分布式文件存储的数据库。由C++语言编写。旨在为WEB应用提供可扩展的高性能数据存储解决方案。
MongoDB是一个介于关系数据库和非关系数据库之间的产品,是非关系数据库当中功能最丰富,最像关系数据库的。它支持的数据结构非常松散,是类似json的bson格式,因此可以存储比较复杂的数据类型。Mongo最大的特点是它支持的查询语言非常强大,其语法有点类似于面向对象的查询语言,几乎可以实现类似关系数据库单表查询的绝大部分功能,而且还支持对数据建立索引。【来源百科】
2.2 MongoDB的特点
- MongoDB 是一个面向文档存储的数据库,操作起来比较简单和容易。
- MongoDB记录中支持属性的索引。
- MongoDB支持创建数据镜像,这使得其有更强的扩展性。
- Mongo支持丰富的查询表达式。查询指令使用JSON形式的标记,可轻易查询文档中内嵌的对象及数组。
- Mongodb中的Map/reduce主要是用来对数据进行批量处理和聚合操作。
- GridFS是MongoDB中的一个内置功能,可以用于存放大量小文件。
- MongoDB支持各种编程语言:RUBY,PYTHON,JAVA,C++,PHP,C#等多种语言。
3、 安装及启动mongodb
3.1 下载mongodb
下载地址:https://www.mongodb.com/download-center/community
3.2 安装mongodb
运行刚下载的安装包(.msi),选择Next(下一步)。
勾选同意协议,在下一步
选择Custom(自定义)
点击Browse(浏览),选择安装路径
继续选择下一步(将MongoDB安装为服务,也可以不选择,在后面单独配置见步骤3.3)
install mongoDB compass 这是MongoDB官方提供的一个可视化图形工具。选择安装的话会过程会慢些,建议取消勾选,单独安装这个工具,后面也会介绍另外一个可视化图形工具studio3t但收费的。
选择下一步,选择install 等待安装完成,选择Finish
3.3 启动mongodb数据库
3.3.1 准备配置
首先创建几个必要的文件夹和文件:数据库目录(data)、日志目录(logs)和日志文件(mongo.log)及配置文件(mongo.conf)。
配置文件内容如下:主要指定刚刚数据的目录、文件及端口
#数据库路径
dbpath=D:\software\MongoDB\Server\data
#日志输出文件路径
logpath=D:\software\MongoDB\Server\logs\mongo.log
#错误日志采用追加模式
logappend=true
#启用日志文件,默认启用
journal=true
#这个选项可以过滤掉一些无用的日志信息,若需要调试使用请设置为false
quiet=true
#端口号 默认为27017
port=27017
3.3.2 安装 mongodb服务
通过执行bin/mongod.exe,使用–install选项来安装服务,使用–config选项来指定之前创建的配置文件。 cmd进入server的bin目录,执行下面命令
mongod.exe ‐‐config ../mongo.co