雪花算法-Snowflake

Snowflake是Twitter提出来的一个算法,其目的是生成一个64bit的整数:

1bit:一般是符号位,不做处理

41bit:用来记录时间戳,这里可以记录69年,如果设置好起始时间比如今年是2018年,那么可以用到2089年,到时候怎么办?要是这个系统能用69年,我相信这个系统早都重构了好多次了。

10bit:10bit用来记录机器ID,总共可以记录1024台机器,一般用前5位代表数据中心,后面5位是某个数据中心的机器ID

12bit:循环位,用来对同一个毫秒之内产生不同的ID,12位可以最多记录4095个,也就是在同一个机器同一毫秒最多记录4095个,多余的需要进行等待下毫秒。

上面只是一个将64bit划分的标准,当然也不一定这么做,可以根据不同业务的具体场景来划分,比如下面给出一个业务场景:

服务目前QPS10万,预计几年之内会发展到百万。

当前机器三地部署,上海,北京,深圳都有。

当前机器10台左右,预计未来会增加至百台。

这个时候我们根据上面的场景可以再次合理的划分62bit,QPS几年之内会发展到百万,那么每毫秒就是千级的请求,目前10台机器那么每台机器承担百级的请求,为了保证扩展,后面的循环位可以限制到1024,也就是2^10,那么循环位10位就足够了。

机器三地部署我们可以用3bit总共8来表示机房位置,当前的机器10台,为了保证扩展到百台那么可以用7bit 128来表示,时间位依然是41bit,那么还剩下64-10-3-7-41-1 = 2bit,还剩下2bit可以用来进行扩展。

时钟回拨

因为机器的原因会发生时间回拨,我们的雪花算法是强依赖我们的时间的,如果时间发生回拨,有可能会生成重复的ID,在我们上面的nextId中我们用当前时间和上一次的时间进行判断,如果当前时间小于上一次的时间那么肯定是发生了回拨,算法会直接抛出异常.

# Twitter's Snowflake algorithm implementation which is used to generate distributed IDs.

# https://github.com/twitter-archive/snowflake/blob/snowflake-2010/src/main/scala/com/twitter/service/snowflake/IdWorker.scala

import time

import logging

from .exceptions import InvalidSystemClock

# 64位ID的划分

WORKER_ID_BITS = 5

DATACENTER_ID_BITS = 5

SEQUENCE_BITS = 12

# 最大取值计算

MAX_WORKER_ID = -1 ^ (-1 << WORKER_ID_BITS) # 2**5-1 0b11111

MAX_DATACENTER_ID = -1 ^ (-1 << DATACENTER_ID_BITS)

# 移位偏移计算

WOKER_ID_SHIFT = SEQUENCE_BITS

DATACENTER_ID_SHIFT = SEQUENCE_BITS + WORKER_ID_BITS

TIMESTAMP_LEFT_SHIFT = SEQUENCE_BITS + WORKER_ID_BITS + DATACENTER_ID_BITS

# 序号循环掩码

SEQUENCE_MASK = -1 ^ (-1 << SEQUENCE_BITS)

# Twitter元年时间戳

TWEPOCH = 1288834974657

logger = logging.getLogger('flask.app')

class IdWorker(object):

"""

用于生成IDs

"""

def __init__(self, datacenter_id, worker_id, sequence=0):

"""

初始化

:param datacenter_id: 数据中心(机器区域)ID

:param worker_id: 机器ID

:param sequence: 其实序号

"""

# sanity check

if worker_id > MAX_WORKER_ID or worker_id < 0:

raise ValueError('worker_id值越界')

if datacenter_id > MAX_DATACENTER_ID or datacenter_id < 0:

raise ValueError('datacenter_id值越界')

self.worker_id = worker_id

self.datacenter_id = datacenter_id

self.sequence = sequence

self.last_timestamp = -1 # 上次计算的时间戳

def _gen_timestamp(self):

"""

生成整数时间戳

:return:int timestamp

"""

return int(time.time() * 1000)

def get_id(self):

"""

获取新ID

:return:

"""

timestamp = self._gen_timestamp()

# 时钟回拨

if timestamp < self.last_timestamp:

logging.error('clock is moving backwards. Rejecting requests until {}'.format(self.last_timestamp))

raise InvalidSystemClock

if timestamp == self.last_timestamp:

self.sequence = (self.sequence + 1) & SEQUENCE_MASK

if self.sequence == 0:

timestamp = self._til_next_millis(self.last_timestamp)

else:

self.sequence = 0

self.last_timestamp = timestamp

new_id = ((timestamp - TWEPOCH) << TIMESTAMP_LEFT_SHIFT) | (self.datacenter_id << DATACENTER_ID_SHIFT) | \

(self.worker_id << WOKER_ID_SHIFT) | self.sequence

return new_id

def _til_next_millis(self, last_timestamp):

"""

等到下一毫秒

"""

timestamp = self._gen_timestamp()

while timestamp <= last_timestamp:

timestamp = self._gen_timestamp()

return timestamp

if __name__ == '__main__':

worker = IdWorker(1, 2, 0)

print(worker.get_id())

同文件夹下建立exceptions.py

class InvalidSystemClock(Exception):

"""

时钟回拨异常

"""

pass

配置文件中添加,对应的是机器ID和序列号

# Snowflake ID Worker 参数

DATACENTER_ID = 0

WORKER_ID = 0

SEQUENCE = 0

python雪花下落代码_雪花算法python实现相关推荐

  1. python画动物代码_如何用python画简单的动物_后端开发

    python3.x完全兼容python2.x吗?_后端开发 可以说是完全不兼容.相对于Python的早期版本,Python3是一个较大的升级,为了不带入过多的累赘,Python 3.0在设计的时候没有 ...

  2. python求表面积代码_用于计算python中的体积或表面积的良好算法

    我正在尝试计算3D numpy数组的体积(或表面积).在许多情况下,体素是各向异性的,并且我在每个方向上具有像素到厘米的转换因子. 有没有人知道找到工具包或包来做上述的好地方? 现在,我有一些内部代码 ...

  3. python计算圆周率代码_用算法实现计算圆周率-几何概型估算圆周率Python编程小程序...

    我在http://tieba.baidu.com/p/5953188922?traceid=看见了一个用 编程计算圆周率的方法 具体详细可以打开链接 发现原作者:百度用户阿泰 C531T因为编程语言的 ...

  4. python语言画图代码_零: python matplotlib 画图进阶(含完整代码)

    导论: 在科研和研究的过程中,无论是哪个学科或者将来走上工作岗位,可视化是非常重要的一个环节. 这里的重要性,在我看来有三点:人是视觉动物,老板看你工作做的怎么样,paper reviewer看你研究 ...

  5. python双重差分代码_即将开班 | Python数据挖掘与Stata应用能力提升与实证前沿寒假工作坊...

    1月25日上午 主讲人:邓旭东 课程安排:python语法入门 1.Python跟英语一样是一种语言 2.数据类型之字符串 3. 数据类型之列表元组集合 4. 数据类型之字典 5.数据类型之布尔值.N ...

  6. python嵌入c代码_怎样把Python代码嵌入到C程序

    匿名用户 1级 2017-11-03 回答 这篇文章主要介绍了将Python代码嵌入C++程序进行编写的实例,尽管通常还是Python代码中调用C++程序的情况较多...需要的朋友可以参考下 把pyt ...

  7. 用python画机器猫代码_如何用Python画一只机器猫?| 原力计划

    原标题:如何用Python画一只机器猫?| 原力计划 作者 | 人邮异步社区 责编 | 胡巍巍 出品 | CSDN博客 自信心是成功的源泉,对刚入门编程行业的初级程序员来说,多敲代码多做项目就是构建自 ...

  8. python下面的代码_求下面python代码的差别。

    展开全部 题主32313133353236313431303231363533e78988e69d8331333433633436你好, 你不明白上面代码的原因,是因为你没弄明白python包导入的相 ...

  9. python项目软件代码_七套Python库快速提升您项目的代码可维护性,软件工程,代码库...

    保护项目未来可维护性的一种理想方式,在于利用外部库检查您的代码运行状况.以下是目前开发人员最喜爱的的代码梳理库,它们能够以强制方式执行一致性样式,并确保项目在成熟之后仍具备可接受的测试覆盖率. 当软件 ...

最新文章

  1. Android巩固之事件分发机制
  2. Pandas简明教程:八、Pandas数据透视表
  3. Cisco 2960 交换机密码设置
  4. GitHub初次使用记录(一)
  5. spring 事务隔离级别和传播行为_Java工程师面试1000题146-Spring数据库事务传播属性和隔离级别...
  6. catalog move.php,catalog.php
  7. 使 JavaScript 更加简洁的小技巧
  8. 20200910:力扣204周周赛题解上(Java/Python/Cpp)
  9. java 获取本机的IP和hostname
  10. python 启动参数_python启动参数
  11. java 分布式系统架构_什么是分布式系统!以及分布式系统架构的优缺点
  12. 查看计算机屏幕颜色软件,电脑屏幕色彩调节工具(f.lux settings)
  13. SpringBoot 使用freemarker 处理文档,找不到文件位置(报错:basePackagePath=““ /* relatively to resourceLoaderClass pkg)
  14. 苹果Mac怎样清除dns缓存?
  15. 调用函数,求加减乘除(基础)。
  16. ERP/MIS系统中集成命令行式的功能调用
  17. PHP网站修改简体字,修改了一个很不错的php验证码(支持中文)
  18. PriceFromImage\UnCodebase
  19. linux命令安装ssl证书
  20. ntp协议客户端服务器模式,思科配置NTP客户端服务器模式

热门文章

  1. 全色和多光谱融合pansharpen的尝试
  2. MySQL多表查询之纵向合并
  3. 【模拟电路】关于NPN和PNP导通的应用以及条件
  4. 学生成绩分等级 --if形式
  5. 大数据时代时代舍恩伯格书资源_疫情宅家,这些大数据书籍可以好好读读
  6. 超详细的SpringBoot+Mybatis+Vue整合笔记
  7. 【面试题目】2019年中心面试题目记录
  8. oracle+怎么清理碎片,oracle 收缩表、清理碎片,释放空间
  9. 背景图片和img图片实用性差异
  10. SSM酒店管理系统旅店(含源码+论文+答辩PPT等)