使用UUID或者GUID产生的ID没有规则

Snowflake算法是Twitter的工程师为实现递增而不重复的ID实现的

概述

分布式系统中,有一些需要使用全局唯一ID的场景,这种时候为了防止ID冲突可以使用36位的UUID,但是UUID有一些缺点,首先他相对比较长,另外UUID一般是无序的。有些时候我们希望能使用一种简单一些的ID,并且希望ID能够按照时间有序生成。而twitter的snowflake解决了这种需求,最初Twitter把存储系统从MySQL迁移到Cassandra,因为Cassandra没有顺序ID生成机制,所以开发了这样一套全局唯一ID生成服务。

该项目地址为:https://github.com/twitter/snowflake是用Scala实现的。

python版详见开源项目https://github.com/erans/pysnowflake。

结构

snowflake的结构如下(每部分用-分开):

0 - 0000000000 0000000000 0000000000 0000000000 0 - 00000 - 00000 - 000000000000

第一位为未使用,接下来的41位为毫秒级时间(41位的长度可以使用69年),然后是5位datacenterId和5位workerId(10位的长度最多支持部署1024个节点) ,最后12位是毫秒内的计数(12位的计数顺序号支持每个节点每毫秒产生4096个ID序号)

一共加起来刚好64位,为一个Long型。(转换成字符串长度为18)

snowflake生成的ID整体上按照时间自增排序,并且整个分布式系统内不会产生ID碰撞(由datacenter和workerId作区分),并且效率较高。据说:snowflake每秒能够产生26万个ID。

从图上看除了第一位不可用之外其它三组均可浮动站位,据说前41位就可以支撑到2082年,10位的可支持1023台机器,最后12位序列号可以在1毫秒内产生4095个自增的ID。

在多线程中使用要加锁。

看懂代码前 先来点计算机常识:<

^异或 :true^true=false   false^false=false  true^false=true false^true=true  例子:  1001^0001=1000

负数的二进制:

第一步:绝对值化为你需要多少位表示的二进制

第二步:各位取反,0变1,1变0

第三步:最后面加1

例子:-1的二进制→      0001  取反→1110→最后面加1→1111

好了废话不多说 直接代码:

1 public classIdWorker2 {3 //机器ID

4 private static longworkerId;5 private static long twepoch = 687888001020L; //唯一时间,这是一个避免重复的随机量,自行设定不要大于当前时间戳

6 private static long sequence = 0L;7 private static int workerIdBits = 4; //机器码字节数。4个字节用来保存机器码(定义为Long类型会出现,最大偏移64位,所以左移64位没有意义)

8 public static long maxWorkerId = -1L ^ -1L << workerIdBits; //最大机器ID

9 private static int sequenceBits = 10; //计数器字节数,10个字节用来保存计数码

10 private static int workerIdShift = sequenceBits; //机器码数据左移位数,就是后面计数器占用的位数

11 private static int timestampLeftShift = sequenceBits + workerIdBits; //时间戳左移动位数就是机器码和计数器总字节数

12 public static long sequenceMask = -1L ^ -1L << sequenceBits; //一微秒内可以产生计数,如果达到该值则等到下一微秒在进行生成

13 private long lastTimestamp = -1L;14

15 ///

16 ///机器码17 ///

18 ///

19 public IdWorker(longworkerId)20 {21 if (workerId > maxWorkerId || workerId < 0)22 throw new Exception(string.Format("worker Id can't be greater than {0} or less than 0", workerId));23 IdWorker.workerId =workerId;24 }25

26 public longnextId()27 {28 lock (this)29 {30 long timestamp =timeGen();31 if (this.lastTimestamp ==timestamp)32 { //同一微秒中生成ID

33 IdWorker.sequence = (IdWorker.sequence + 1) & IdWorker.sequenceMask; //用&运算计算该微秒内产生的计数是否已经到达上限

34 if (IdWorker.sequence == 0)35 {36 //一微秒内产生的ID计数已达上限,等待下一微秒

37 timestamp = tillNextMillis(this.lastTimestamp);38 }39 }40 else

41 { //不同微秒生成ID

42 IdWorker.sequence = 0; //计数清0

43 }44 if (timestamp

46 throw new Exception(string.Format("Clock moved backwards. Refusing to generate id for {0} milliseconds",47 this.lastTimestamp -timestamp));48 }49 this.lastTimestamp = timestamp; //把当前时间戳保存为最后生成ID的时间戳

50 long nextId = (timestamp - twepoch << timestampLeftShift) | IdWorker.workerId << IdWorker.workerIdShift |IdWorker.sequence;51 returnnextId;52 }53 }54

55 ///

56 ///获取下一微秒时间戳57 ///

58 ///

59 ///

60 private long tillNextMillis(longlastTimestamp)61 {62 long timestamp =timeGen();63 while (timestamp <=lastTimestamp)64 {65 timestamp =timeGen();66 }67 returntimestamp;68 }69

70 ///

71 ///生成当前时间戳72 ///

73 ///

74 private longtimeGen()75 {76 return (long)(DateTime.UtcNow - new DateTime(1970, 1, 1, 0, 0, 0, DateTimeKind.Utc)).TotalMilliseconds;77 }78

79 }

调用:

1  IdWorker idworker = new IdWorker(1);2 for (int i = 0; i < 1000; i++)3 {4 Console.WriteLine(idworker.nextId());5 }

其他算法:

方法一:UUID

UUID是通用唯一识别码 (Universally Unique Identifier),在其他语言中也叫GUID,可以生成一个长度32位的全局唯一识别码。

String uuid = UUID.randomUUID().toString()

结果示例:

046b6c7f-0b8a-43b9-b35d-6489e6daee91

为什么无序的UUID会导致入库性能变差呢?

这就涉及到 B+树索引的分裂:

众所周知,关系型数据库的索引大都是B+树的结构,拿ID字段来举例,索引树的每一个节点都存储着若干个ID。

如果我们的ID按递增的顺序来插入,比如陆续插入8,9,10,新的ID都只会插入到最后一个节点当中。当最后一个节点满了,会裂变出新的节点。这样的插入是性能比较高的插入,因为这样节点的分裂次数最少,而且充分利用了每一个节点的空间。

但是,如果我们的插入完全无序,不但会导致一些中间节点产生分裂,也会白白创造出很多不饱和的节点,这样大大降低了数据库插入的性能。

方法二:数据库自增主键

假设名为table的表有如下结构:

id        feild

35        a

每一次生成ID的时候,访问数据库,执行下面的语句:

begin;

REPLACE INTO table ( feild )  VALUES ( 'a' );

SELECT LAST_INSERT_ID();

commit;

REPLACE INTO 的含义是插入一条记录,如果表中唯一索引的值遇到冲突,则替换老数据。

这样一来,每次都可以得到一个递增的ID。

为了提高性能,在分布式系统中可以用DB proxy请求不同的分库,每个分库设置不同的初始值,步长和分库数量相等:

这样一来,DB1生成的ID是1,4,7,10,13....,DB2生成的ID是2,5,8,11,14.....

mysql snowflake_自增ID算法snowflake相关推荐

  1. Twitter的分布式自增ID算法Snowflake实现分析及其Java、Php和Python版

    在分布式系统中,需要生成全局UID的场合还是比较多的,twitter的snowflake解决了这种需求,实现也还是很简单的,除去配置信息,核心代码就是毫秒级时间41位+机器ID 10位+毫秒内序列12 ...

  2. [详解]Twitter开源分布式自增ID算法snowflake,附演算验证过程

    1.snowflake简介 互联网快速发展的今天,分布式应用系统已经见怪不怪,在分布式系统中,我们需要各种各样的ID,既然是ID那么必然是要保证全局唯一,除此之外,不同当业务还需要不同的特性,比如像并 ...

  3. 分布式自增ID算法-Snowflake详解

    1.Snowflake简介 互联网快速发展的今天,分布式应用系统已经见怪不怪,在分布式系统中,我们需要各种各样的ID,既然是ID那么必然是要保证全局唯一,除此之外,不同当业务还需要不同的特性,比如像并 ...

  4. 基于.NET Standard的分布式自增ID算法--Snowflake

    概述 本篇文章主要讲述分布式ID生成算法中最出名的Snowflake算法.搞.NET开发的,数据库主键最常见的就是int类型的自增主键和GUID类型的uniqueidentifier. 那么为何还要引 ...

  5. Twitter的分布式自增ID算法snowflake (Java版)

    概述 分布式系统中,有一些需要使用全局唯一ID的场景,这种时候为了防止ID冲突可以使用36位的UUID,但是UUID有一些缺点,首先他相对比较长,另外UUID一般是无序的. 有些时候我们希望能使用一种 ...

  6. snowflake做主键 自增_自增ID算法snowflake - C#版

    急景流年,铜壶滴漏,时光缱绻如画,岁月如诗如歌.转载一篇博客来慰藉,易逝的韶华. 使用UUID或者GUID产生的ID没有规则 Snowflake算法是Twitter的工程师为实现递增而不重复的ID实现 ...

  7. Twitter的分布式自增ID算法snowflake

    全局ID 要做到幂等性的交易接口,需要有一个唯一的标识,来标志交易是同一笔交易.而这个交易ID由谁来分配是一件比较头疼的事.因为这个标识要能做到全局唯一. 如果由一个中心系统来分配,那么每一次交易都需 ...

  8. Twitter-Snowflake,64位自增ID算法详解

    Twitter-Snowflake,64位自增ID算法详解 from: http://www.lanindex.com/twitter-snowflake%EF%BC%8C64%E4%BD%8D%E8 ...

  9. MySQL 使用自增ID主键和UUID 作为主键的优劣比較具体过程(从百万到千万表记录測试)...

    測试缘由 一个开发同事做了一个框架.里面主键是uuid.我跟他建议说mysql不要用uuid用自增主键,自增主键效率高,他说不一定高,我说innodb的索引特性导致了自增id做主键是效率最好的,为了拿 ...

最新文章

  1. spring boot 异常(exception)处理
  2. Android动态加载技术初探
  3. C语言-getopt函数
  4. Qt窗口在屏幕上居中显示
  5. 有关ftp4j的FTPListParseException异常
  6. 两数之和—leetcode2
  7. 包含用法 includeFilters
  8. POJ2402 Palindrome Numbers 回文数
  9. 前端工作笔记-Nginx安装及vue cli部署
  10. 从青铜到王者,来聊聊 Synchronized 底层实现原理 | 原力计划
  11. php properties,PHP ReflectionClass getStaticProperties()用法及代码示例
  12. 招C++高手及强力美工
  13. 信贷违约风险评估模型(中篇):特征工程
  14. 富士康计划将苹果生产线转移到越南,是什么原因呢?
  15. ubuntu下安装CAJ阅读器
  16. vue json对象转数组_分享:vue使用技巧和项目中遇到的问题
  17. 安卓搞机教程--修改设置里 添加选项 添加文字 修改图标 修改版本号等等 实例解析
  18. ​​​​​​​【目标检测】CenterNet
  19. 《密码安全新技术》课程总结报告
  20. ​谁是信创担当——《2021中国信创生态市场研究报告》正式发布

热门文章

  1. C# 字节数组、字符串转化
  2. 使用Ad Rotator组件的问题
  3. 兼容:ie浏览器密码框出现眼睛图标问题
  4. 如何设定员工满意度调研的维度?
  5. 无法找到vcredist.msi
  6. 使用GIT和Visual Studio Code新建工作及切换分支步骤
  7. 惠普eliteone 800 G2 触屏电脑蓝屏彻底解决方法(拆机,装盘,BIOS设置,U盘大师在线安装,下载安装驱动,ghost备份 )
  8. 虚拟机VMware安装Ubuntu20.04
  9. css 边框太粗_9个很棒的CSS边框技巧
  10. 尚硅谷VUE项目-前端项目问题总结07--产品详情页【vuex-排他操作foreach-放大镜-轮播图-兄弟组件通信$bus-购物车-路由跳转传参-路由传参+会话存储】-游客身份-节流