数据库的建立必须遵循一定的规则。在关系数据库中,这种规则就是范式。范式是符合某一种级别的关系模式的集合。关系数据库中的关系必须满足一定的要求,即满足不同的范式。目前关系数据库有六种范式:第一范式(1nf)、第二范式(2nf)、第三范式(3nf)、第四范式(4nf)、第五范式(5nf)和第六范式(6nf)。满足最低要求的范式是第一范式(1nf)。在第一范式的基础上进一步满足更多的要求称为第二范式(2nf),其余范式以次类推。一般说来,数据库只需满足第三范式(3nf)就行了。
下面我们举例介绍第一范式(1nf)、第二范式(2nf)和第三范式(3nf)。
第一范式(1nf)
在任何一个关系数据库中,第一范式(1nf)是对关系模式的基本要求,不满足第一范式(1nf)的数据库就不是关系数据库。
所谓第一范式(1nf)是指数据库表的每一列都是不可分割的基本数据项,同一列中不能有多个值,即实体中的某个属性的值不能有多个或者不能有重复的属性。如果出现重复的属性,就可能需要定义一个新的实体,新的实体由重复的属性构成,新实体与原实体之间为一对多关系。在第一范式(1nf)中表的每一行只包含一个实例的信息。简而言之,第一范式就是无重复的列。
第二范式(2nf)
第二范式(2nf)是在第一范式(1nf)的基础上建立起来的,即满足第二范式(2nf)必须先满足第一范式(1nf)。第二范式(2nf)要求数据库表中的每个实例或行必须可以被惟一的区分。为实现区分通常需要为表加上一个列,以存储各个实例的惟一标识。
第二范式(2nf)要求实体的属性完全依赖于主关键字。所谓完全依赖是指不能存在仅依赖主关键字一部分的属性,如果存在,那么这个属性和主关键字的这一部分应该分离出来形成一个新的实体,新实体与原实体之间是一对多的关系。为实现区分通常需要为表加上一个列,以存储各个实例的惟一标识。简而言之,第二范式就是非主属性非部分依赖于主关键字。
第三范式(3nf)
满足第三范式(3nf)必须先满足第二范式(2nf)。简而言之,第三范式(3nf)要求一个数据库表中不包含已在其它表中已包含的非主关键字信息。例如,存在一个部门信息表,其中每个部门有部门编号(dept_id)、部门名称、部门简介等信息。员工信息表中列出部门编号后就不能再将部门名称、部门简介等与部门有关的信息再加入员工信息表中。如果不存在部门信息表,则根据第三范式(3nf)也应该构建它,否则就会有大量的数据冗余。简而言之,第三范式就是属性不依赖于其它非主属性。
名词解说:
【范式】:所谓范式就是符合某一种级别的关系模式的集合。
【规范化】:通过分解把属于低级范式的关系模式转换为几个属于高级范式的关系模式的集合,这一过程称为规范化。
案例:
第一范式-1NF:
字段不可以再分,有主关键字,或者外键。
简言之:第一范式就是无重复的列。
第二范式-2NF:
非主属性完全依赖于主键(组合主键),取消非主属性依赖于部分主键。
备注:
班级号(全校唯一标识符) 学科(语文,数学等) 老师工号 老师姓名 班级名称
这个表的主键是(班级号,学科), (班级号,学科)决定了(老师工号,老师姓名,班级名称)
但是因为班级名称只依赖于部分的主键(班级号),所以不符合第二范式2NF
修改之后为:
班级号(全校唯一标识符) 学科(语文,数学等) 老师工号 老师姓名
第三范式-3NF:
非主属性只完全依赖于主键(组合主键),非主属性不依赖于其它非主属性。
继续上面的例子:
班级号(全校唯一标识符) 学科(语文,数学等) 老师工号 老师姓名
这个表的主键是(班级号,学科), (班级号,学科)决定了(老师工号,老师姓名)
但是老师姓名只依赖于老师工号。所以这个例子满足了2NF,但是不满足3NF。
修改之后为:
班级号(全校唯一标识符) 学科(语文,数学等) 老师工号
2NF和3NF都是为了取消冗余。
我觉得2和3的区别就是,依赖的对象是否为主键。
2是取消依赖于部分主键的非主属性
3是取消依赖于非主键的非主属性