目录
产生的背景
- 使用uuid虽然可以作为不重复主键Id,unid是一个无序的字符串,作为主键时,主键索引会生效。
- 数据库表用特点库中的一张表维护时,在自增的时候查表然后update,在操作的过程中需要锁边,不适合并发量大的项目。
- redis中维护一个键值对,然后哪个表需要直接去redis中取值然后加一,但是这个跟上面一样由于单线程都是对高并发的支持不高,只适合并发量小的项目。
组成结构
64 bit 的 long 型数字(二进制)
- 1 个 bit:0,这个是无意义的。
- 41 个 bit:表示的是时间戳
- 5 个 bit:表示的是机房 id(可以存在2^5个机房)
- 5 个 bit:表示的是机器 id(可以存在2^5个机器)
- 12 个 bit:表示的序号,就是某个机房某台机器上这一毫秒内同时生成的 id 的序号
机房+机器的组合可以部署在1024个机器(已经很大和很大)
优点
- 不依赖数据,在内存中直接生成
- 容量大,高可用高并放
- ID自增,存入数据库后,索引效率高
缺点
依赖系统的时间,当系统时间刻意发送改变时,可能会造成ID重复(理论上会发生,现实不会改变系统时间)
相关代码
public class SnowFlake {
// 机器ID 2进制5位 32位减掉1位 31个
private long camputerId;
// 机房ID 2进制5位 32位减掉1位 31个
private long homeId;
// 代表一毫秒内生成的多个id的最新序号 12位 4096 -1 = 4095 个
private long sequence;
// 设置一个时间初始值 2^41 - 1 差不多可以用69年
private long twepoch = 1585644268888L;
// 5位的机器id
private long workerIdBits = 5L;
// 5位的机房id
private long datacenterIdBits = 5L;
// 每毫秒内产生的id数 2 的 12次方
private long sequenceBits = 12L;
// 这个是二进制运算,就是5 bit最多只能有31个数字,也就是说机器id最多只能是32以内
private long maxWorkerId = -1L ^ (-1L << workerIdBits);
// 这个是一个意思,就是5 bit最多只能有31个数字,机房id最多只能是32以内
private long maxDatacenterId = -1L ^ (-1L << datacenterIdBits);
private long workerIdShift = sequenceBits;
private long datacenterIdShift = sequenceBits + workerIdBits;
private long timestampLeftShift = sequenceBits + workerIdBits + datacenterIdBits;
private long sequenceMask = -1L ^ (-1L << sequenceBits);
// 记录产生时间毫秒数,判断是否是同1毫秒
private long lastTimestamp = -1L;
public long getCamputerId() {
return camputerId;
}
public long getHomeId() {
return homeId;
}
public long getTimestamp() {
return System.currentTimeMillis();
}
public SnowFlake(long camputerId, long homeId, long sequence) {
// 检查机房id和机器id是否超过31 不能小于0
if (camputerId > maxWorkerId || camputerId < 0) {
throw new IllegalArgumentException(
String.format("worker Id can't be greater than %d or less than 0", maxWorkerId));
}
if (homeId > maxDatacenterId || homeId < 0) {
throw new IllegalArgumentException(
String.format("datacenter Id can't be greater than %d or less than 0", maxDatacenterId));
}
this.camputerId = camputerId;
this.homeId = homeId;
this.sequence = sequence;
}
// 这个是核心方法,通过调用nextId()方法,让当前这台机器上的snowflake算法程序生成一个全局唯一的id
public synchronized long nextId() {
// 这儿就是获取当前时间戳,单位是毫秒
long timestamp = getTime();
if (timestamp < lastTimestamp) {
System.err.printf("clock is moving backwards. Rejecting requests until %d.", lastTimestamp);
throw new RuntimeException(
String.format(
"Clock moved backwards. Refusing to generate id for %d milliseconds",
lastTimestamp - timestamp));
}
// 下面是说假设在同一个毫秒内,又发送了一个请求生成一个id
// 这个时候就得把seqence序号给递增1,最多就是4096
if (lastTimestamp == timestamp) {
// 这个意思是说一个毫秒内最多只能有4096个数字,无论你传递多少进来,
// 这个位运算保证始终就是在4096这个范围内,避免你自己传递个sequence超过了4096这个范围
sequence = (sequence + 1) & sequenceMask;
// 当某一毫秒的时间,产生的id数 超过4095,系统会进入等待,直到下一毫秒,系统继续产生ID
if (sequence == 0) {
timestamp = tilNextMillis(lastTimestamp);
}
} else {
sequence = 0;
}
// 这儿记录一下最近一次生成id的时间戳,单位是毫秒
lastTimestamp = timestamp;
// 最核心的二进制位运算操作,生成一个64bit的id
// 将当前时间戳左移,放到41 bit那儿;将机房id左移放到5 bit那儿;将机器id左移放到5 bit那儿;将序号放最后12 bit
// 最后拼接起来成一个64 bit的二进制数字,转换成10进制就是个long型
return ((timestamp - twepoch) << timestampLeftShift)
| (homeId << datacenterIdShift)
| (camputerId << workerIdShift)
| sequence;
}
/**
* 当某一毫秒的时间,产生的id数 超过4095,系统会进入等待,直到下一毫秒,系统继续产生ID
*
* @param lastTimestamp
* @return
*/
private long tilNextMillis(long lastTimestamp) {
long timestamp = getTime();
while (timestamp <= lastTimestamp) {
timestamp = getTime();
}
return timestamp;
}
// 获取当前时间戳
private long getTime() {
return System.currentTimeMillis();
}
/**
* main 测试类
*
* @param args
*/
public static void main(String[] args) {
SnowFlake snowFlak = new SnowFlake(5, 6, 4596);
for (int i = 0; i < 100; i++) System.out.println(snowFlak.nextId());
}
}