引擎的名称大小写敏感
表引擎(即表的类型)决定了:
1)数据的存储方式和位置,写到哪里以及从哪里读取数据
2)支持哪些查询以及如何支持。
3)并发数据访问。
4)索引的使用(如果存在)。
5)是否可以执行多线程请求。
6)数据复制参数。
ClickHouse的表引擎有很多,下面介绍其中几种,对其他引擎有兴趣的可以去查阅官方文档:官方文档
分区:
是为了分区间能够并行计算
数据其实是先写到临时分区, 后续才被合并到现有分区
分区目录: 由文件+索引文件+表定义文件
组成
主键:
它只提供了数据的一级索引
,但不是唯一约束
是稀疏索引(类似于跳表)
二级索引
TTL:
数据的存活时间, 数据过期失效后不会立即清除
, 而是在合并时才进行清除, 被清除前这个数据依旧是可见的
它的清除不是为了业务去及时清除过期数据, 而只是为了节省内存才清除失效数据
order by:
设定了分区内
数据按照哪些字段 进行有序地保存
主键必须是order by字段的前缀字段, 比如 order by的字段是(id,sku_id)时, 那么主键必须是id 或者(id,sku_id)
可作ReplacingMergeTree里的去重字段
, 和SummingMergeTree里的维度字段
TinyLog
最简单的表引擎,用于将数据存储在磁盘上。每列都存储在单独的压缩文件中,写入时,数据将附加到文件末尾。
该引擎没有并发控制
●如果同时从表中读取和写入数据,则读取操作将抛出异常;
●如果同时写入多个查询中的表,则数据将被破坏。
这种表引擎的典型用法是 write-once:首先只写入一次数据,然后根据需要多次读取。此引擎适用于相对较小的表(建议最多1,000,000行)。如果有许多小表,则使用此表引擎是适合的,因为它比需要打开的文件更少。当拥有大量小表时,可能会导致性能低下。 不支持索引。
案例:创建一个TinyLog引擎的表并插入一条数据
此时我们到保存数据的目录/var/lib/clickhouse/data/default/t中可以看到如下目录结构:
a.bin 和 b.bin 是压缩过的对应的列的数据, sizes.json 中记录了每个 *.bin 文件的大小:
:)create table t (a UInt16, b String) ENGINE = TinyLog; :)insert into t (a, b) values (1, 'abc'); |
Memory
内存引擎,数据以未压缩的原始形式直接保存在内存当中,服务器重启数据就会消失。读写操作不会相互阻塞