1、数据的完整性
一个数据库就是一个完整的业务单元,可以包含多张表,数据被存储在表中
在表中为了更加准确的存储数据,保证数据的正确有效,可以在创建表的时候,为表添加一些强制性的验证,包括数据字段的类型、约束
(1)数据类型
可以通过查看帮助文档查阅所有支持的数据类型
使用数据类型的原则是:够用就行,尽量使用取值范围小的,而不用大的,这样可以更多的节省存储空间
常用数据类型如下:
- 整数:int,bit
- 小数:decimal
- 字符串:varchar,char
- 日期时间: date, time, datetime
- 枚举类型(enum)
特别说明的类型如下:
- decimal表示浮点数,如decimal(5,2)表示共存5位数,小数占2位
- char表示固定长度的字符串,如char(3),如果填充’ab’时会补一个空格为’ab ’
- varchar表示可变长度的字符串,如varchar(3),填充’ab’时就会存储’ab’
- 字符串text表示存储大文本,当字符大于4000时推荐使用
- 对于图片、音频、视频等文件,不存储在数据库中,而是上传到某个服务器上,然后在表中存储这个文件的保存路径
更全的数据类型可以参考这个http://blog.csdn.net/anxpp/article/details/51284106
(2)约束
- 主键primary key:物理上存储的顺序
- 非空not null:此字段不允许填写空值
- 惟一unique:此字段的值不允许重复
- 默认default:当不填写此值时会使用默认值,如果填写时以填写为准
- 外键foreign key:对关系字段进行约束,当为关系字段填写值时,会到关联的表中查询此值是否存在,如果存在则填写成功,如果不存在则填写失败并抛出异常
说明:虽然外键约束可以保证数据的有效性,但是在进行数据的crud(增加、修改、删除、查询)时,都会降低数据库的性能,所以不推荐使用,那么数据的有效性怎么保证呢?
答:可以在逻辑层进行控制
数值类型(常用)
字符串
日期时间类型
(3)数据库设的设计
关系型数据库建议在E-R模型的基础上,我们需要根据产品经理的设计策划,抽取出来模型与关系,制定出表结构,这是项目开始的第一步
在开发中有很多设计数据库的软件,常用的如power designer,db desinger等,这些软件可以直观的看到实体及实体间的关系
设计数据库,可能是由专门的数据库设计人员完成,也可能是由开发组成员完成,一般是项目经理带领组员来完成
现阶段不需要独立完成数据库设计,但是要注意积累一些这方面的经验
1)三范式
经过研究和对使用中问题的总结,对于设计数据库提出了一些规范,这些规范被称为范式(Normal Form); 目前有迹可寻的共有8种范式,一般需要遵守3范式即可:
◆ 第一范式(1NF):强调的是列的原子性,即列不能够再分成其他几列。
考虑这样一个表:【联系人】(姓名,性别,电话) 如果在实际场景中,一个联系人有家庭电话和公司电话,那么这种表结构设计就没有达到 1NF。要符合 1NF 我们只需把列(电话)拆分,即:【联系人】(姓名,性别,家庭电话,公司电话)。1NF 很好辨别,但是 2NF 和 3NF 就容易搞混淆。
不遵循1NF
◆ 第二范式(2NF):首先是 1NF,另外包含两部分内容,一是表必须有一个主键;二是没有包含在主键中的列必须完全依赖于主键,而不能只依赖于主键的一部分。
考虑一个订单明细表:【OrderDetail】(OrderID,ProductID,UnitPrice,Discount,Quantity,ProductName)。 因为我们知道在一个订单中可以订购多种产品,所以单单一个 OrderID 是不足以成为主键的,主键应该是(OrderID,ProductID)。显而易见 Discount(折扣),Quantity(数量)完全依赖(取决)于主键(OderID,ProductID),而 UnitPrice,ProductName 只依赖于 ProductID。所以 OrderDetail 表不符合 2NF。不符合 2NF 的设计容易产生冗余数据。
可以把【OrderDetail】表拆分为【OrderDetail】(OrderID,ProductID,Discount,Quantity)和【Product】(ProductID,UnitPrice,ProductName)来消除原订单表中UnitPrice,ProductName多次重复的情况。
不遵循2NF
◆ 第三范式(3NF):首先是 2NF,另外非主键列必须直接依赖于主键,不能存在传递依赖。即不能存在:非主键列 A 依赖于非主键列 B,非主键列 B 依赖于主键的情况。
考虑一个订单表【Order】(OrderID,OrderDate,CustomerID,CustomerName,CustomerAddr,CustomerCity)主键是(OrderID)。 其中 OrderDate,CustomerID,CustomerName,CustomerAddr,CustomerCity 等非主键列都完全依赖于主键(OrderID),所以符合 2NF。不过问题是 CustomerName,CustomerAddr,CustomerCity 直接依赖的是 CustomerID(非主键列),而不是直接依赖于主键,它是通过传递才依赖于主键,所以不符合 3NF。 通过拆分【Order】为【Order】(OrderID,OrderDate,CustomerID)和【Customer】(CustomerID,CustomerName,CustomerAddr,CustomerCity)从而达到 3NF。 *第二范式(2NF)和第三范式(3NF)的概念很容易混淆,区分它们的关键点在于,2NF:非主键列是否完全依赖于主键,还是依赖于主键的一部分;3NF:非主键列是直接依赖于主键,还是直接依赖于非主键列。
不遵循3NF
最终表
2)E-R模型
E表示entry,实体, 设计实体就像定义一个类一样,指定从哪些方面描述对象,一个实体转换为数据库中的一个表
R表示relationship,关系, 关系描述两个实体之间的对应规则,关系的类型包括包括一对一、一对多、多对多
关系也是一种数据,需要通过一个字段存储在表中
- 实体A对实体B为1对1,则在表A或表B中创建一个字段,存储另一个表的主键值
- 实体A对实体B为1对多:在表B中创建一个字段,存储表A的主键值
- 实体A对实体B为多对多:新建一张表C,这个表只有两个字段,一个用于存储A的主键值,一个用于存储B的主键值
3)逻辑删除
对于重要数据,并不希望物理删除,一旦删除,数据无法找回
删除方案:设置isDelete的列,类型为bit,表示逻辑删除,默认值为0
对于非重要数据,可以进行物理删除
数据的重要性,要根据实际开发决定
2、利用命令行使用SQL语句
(1)MySQL连接
1)连接MySQL
mysql -uroot -p
回车后输入密码,当前设置的密码为mysql
连接成功如图:
2)退出登录
quit 和 exit
或
ctrl+d
3)查看时间
select now();
4)查看版本
select version();
(2)数据库
1)查看当前数据库
show databases;
2)创建数据库
create database 数据库名;
最好是都有指定编码创建,不然容易出现中文不能存在的情况,我就遇到了
create database 数据库名 charset=utf8;
3)使用数据库
use 数据库名;
4)查看当前使用的数据库
select database();
5)删除数据库
drop database 数据库名;
(2)数据表
1)创建表
- auto_increment 表示自动增长
- not null 表示不能为空
- primary key 表示主键
- default 表示默认值
CREATE TABLE 数据表名字(
字段 字段类型[(字段长度)] 约束,
column2 datatype,
column3 datatype,
.....
columnN datatype,
PRIMARY KEY(one or more columns)
);
上面我创建这个python02未设置编码utf8导致这里出现错误
Column 'e_sxe' has duplicated value '?' in ENUM
解决方案就是在创建表数据后再设置,如下图:
engine=InnoDB default charset=utf8;
注:enum表示枚举,即可以选择填取只有约定的这几个值,enum存储数据是按照顺序存储,也可以填写1,2来对应枚举里的值。
2)查看当前数据库中所有表
show tables;
3)查看表结构
desc 表名;
4)添加数据以及查看数据
添加数据:
insert into 表名 values(字段1对应的值,字段2对应值,……);
查看数据:
select * from 表名;
5)查看表的创建语句
show create table 表名;
6)增删改
- 修改表-添加字段
alter table 表名 add 字段名 类型;
- 修改表-修改字段:不重命名版
alter table 表名 modify 列名 类型及约束;
- 修改表-修改字段:重命名版
alter table 表名 change 原名 新名 类型及约束;
- 修改表-删除字段
alter table 表名 drop 列名;
7)删除表
drop table 表名;
(3)数据增删改查
1)增加
INSERT [INTO] tb_name [(col_name,...)] {VALUES | VALUE} ({expr | DEFAULT},...),(...),...
说明:主键列是自动增长,但是在全列插入时需要占位,通常使用0或者 default 或者 null 来占位,插入成功后以实际数据为准
- 全列插入:值的顺序与表中字段的顺序对应
insert into 表名 values(...)
- 部分列插入:值的顺序与给出的列顺序对应
insert into 表名(列1,...) values(值1,...)
- 上面的语句一次可以向表中插入一行数据,还可以一次性插入多行数据,这样可以减少与数据库的通信
insert into 表名(列1,...) values(值1,...),(值1,...)...;
- 全列多行插入:值的顺序与给出的列顺序对应
insert into 表名 values(...),(...)...;
2)删除
DELETE FROM tbname [where 条件判断]
- 物理删除
delete from 表名 where 条件
- 逻辑删除,本质就是修改操作让数据条件受限不出现,从而避免误删
alter table students add is_delete bit default=0;
update 表名 set is_delete=1 where 条件
3)修改
UPDATE tbname SET col1={expr1|DEFAULT} [,col2={expr2|default}]...[where 条件判断]
update 表名 set 列1=值1,列2=值2... where 条件
4)查询基本使用
- 查询所有列
select * from 表名;
- 查询指定条件的列
select 列1,列2,... from 表名;
- 查询指定列
select 列名 ,列名 from 表名 ;
- 查询指定列并将列名修改
select 列名 as 新列名 ,列名 as 新列名 from 表名 ;
注:谁放在前面就把前面的数据放前面,比如性别放在前面,则选择出来的数据性别在前