snowflake做主键自增_自增ID算法snowflake

作者：汶汐_782 | 来源：互联网 | 2023-09-25 18:23

使用UUID或者GUID产生的ID没有规则Snowflake算法是Twitter的工程师为实现递增而不重复的ID实现的概述分布式系统中，有一些需要使用全局唯一ID的场

使用UUID或者GUID产生的ID没有规则

Snowflake算法是Twitter的工程师为实现递增而不重复的ID实现的

概述

分布式系统中&＃xff0c;有一些需要使用全局唯一ID的场景&＃xff0c;这种时候为了防止ID冲突可以使用36位的UUID&＃xff0c;但是UUID有一些缺点&＃xff0c;首先他相对比较长&＃xff0c;另外UUID一般是无序的。有些时候我们希望能使用一种简单一些的ID&＃xff0c;并且希望ID能够按照时间有序生成。而twitter的snowflake解决了这种需求&＃xff0c;最初Twitter把存储系统从MySQL迁移到Cassandra&＃xff0c;因为Cassandra没有顺序ID生成机制&＃xff0c;所以开发了这样一套全局唯一ID生成服务。

该项目地址为&＃xff1a;https://github.com/twitter/snowflake是用Scala实现的。

python版详见开源项目https://github.com/erans/pysnowflake。

结构

snowflake的结构如下(每部分用-分开):

0 - 0000000000 0000000000 0000000000 0000000000 0 - 00000 - 00000 - 000000000000

第一位为未使用&＃xff0c;接下来的41位为毫秒级时间(41位的长度可以使用69年)&＃xff0c;然后是5位datacenterId和5位workerId(10位的长度最多支持部署1024个节点) &＃xff0c;最后12位是毫秒内的计数(12位的计数顺序号支持每个节点每毫秒产生4096个ID序号)

一共加起来刚好64位&＃xff0c;为一个Long型。(转换成字符串长度为18)

snowflake生成的ID整体上按照时间自增排序&＃xff0c;并且整个分布式系统内不会产生ID碰撞(由datacenter和workerId作区分)&＃xff0c;并且效率较高。据说&＃xff1a;snowflake每秒能够产生26万个ID。

从图上看除了第一位不可用之外其它三组均可浮动站位&＃xff0c;据说前41位就可以支撑到2082年&＃xff0c;10位的可支持1023台机器&＃xff0c;最后12位序列号可以在1毫秒内产生4095个自增的ID。

在多线程中使用要加锁。

看懂代码前先来点计算机常识&＃xff1a;<

^异或 &＃xff1a;true^true&＃61;false false^false&＃61;false true^false&＃61;true false^true&＃61;true 例子&＃xff1a; 1001^0001&＃61;1000

负数的二进制&＃xff1a;

第一步:绝对值化为你需要多少位表示的二进制

第二步:各位取反,0变1,1变0

第三步:最后面加1

例子&＃xff1a;-1的二进制→ 0001 取反→1110→最后面加1→1111

好了废话不多说直接代码&＃xff1a;

1 public classIdWorker2 {3 //机器ID

4 private static longworkerId;5 private static long twepoch &＃61; 687888001020L; //唯一时间&＃xff0c;这是一个避免重复的随机量&＃xff0c;自行设定不要大于当前时间戳

6 private static long sequence &＃61; 0L;7 private static int workerIdBits &＃61; 4; //机器码字节数。4个字节用来保存机器码(定义为Long类型会出现&＃xff0c;最大偏移64位&＃xff0c;所以左移64位没有意义)

8 public static long maxWorkerId &＃61; -1L ^ -1L <

9 private static int sequenceBits &＃61; 10; //计数器字节数&＃xff0c;10个字节用来保存计数码

10 private static int workerIdShift &＃61; sequenceBits; //机器码数据左移位数&＃xff0c;就是后面计数器占用的位数

11 private static int timestampLeftShift &＃61; sequenceBits &＃43; workerIdBits; //时间戳左移动位数就是机器码和计数器总字节数

12 public static long sequenceMask &＃61; -1L ^ -1L <

13 private long lastTimestamp &＃61; -1L;14

15 ///

16 ///机器码17 ///

18 ///

19 public IdWorker(longworkerId)20 {21 if (workerId > maxWorkerId || workerId <0)22 throw new Exception(string.Format("worker Id can&＃39;t be greater than {0} or less than 0", workerId));23 IdWorker.workerId &＃61;workerId;24 }25

26 public longnextId()27 {28 lock (this)29 {30 long timestamp &＃61;timeGen();31 if (this.lastTimestamp &＃61;&＃61;timestamp)32 { //同一微秒中生成ID

33 IdWorker.sequence &＃61; (IdWorker.sequence &＃43; 1) & IdWorker.sequenceMask; //用&运算计算该微秒内产生的计数是否已经到达上限

34 if (IdWorker.sequence &＃61;&＃61; 0)35 {36 //一微秒内产生的ID计数已达上限&＃xff0c;等待下一微秒

37 timestamp &＃61; tillNextMillis(this.lastTimestamp);38 }39 }40 else

41 { //不同微秒生成ID

42 IdWorker.sequence &＃61; 0; //计数清0

43 }44 if (timestamp

46 throw new Exception(string.Format("Clock moved backwards. Refusing to generate id for {0} milliseconds",47 this.lastTimestamp -timestamp));48 }49 this.lastTimestamp &＃61; timestamp; //把当前时间戳保存为最后生成ID的时间戳

50 long nextId &＃61; (timestamp - twepoch <

55 ///

56 ///获取下一微秒时间戳57 ///

58 ///

59 ///

60 private long tillNextMillis(longlastTimestamp)61 {62 long timestamp &＃61;timeGen();63 while (timestamp <&＃61;lastTimestamp)64 {65 timestamp &＃61;timeGen();66 }67 returntimestamp;68 }69

70 ///

71 ///生成当前时间戳72 ///

73 ///

74 private longtimeGen()75 {76 return (long)(DateTime.UtcNow - new DateTime(1970, 1, 1, 0, 0, 0, DateTimeKind.Utc)).TotalMilliseconds;77 }78

79 }

调用&＃xff1a;

1 　IdWorker idworker &＃61; new IdWorker(1);2 for (int i &＃61; 0; i <1000; i&＃43;&＃43;)3 {4 Console.WriteLine(idworker.nextId());5 }

其他算法&＃xff1a;

方法一&＃xff1a;UUID

UUID是通用唯一识别码 (Universally Unique Identifier)&＃xff0c;在其他语言中也叫GUID&＃xff0c;可以生成一个长度32位的全局唯一识别码。

String uuid &＃61; UUID.randomUUID().toString()

结果示例&＃xff1a;

046b6c7f-0b8a-43b9-b35d-6489e6daee91

为什么无序的UUID会导致入库性能变差呢&＃xff1f;

这就涉及到 B&＃43;树索引的分裂&＃xff1a;

众所周知&＃xff0c;关系型数据库的索引大都是B&＃43;树的结构&＃xff0c;拿ID字段来举例&＃xff0c;索引树的每一个节点都存储着若干个ID。

如果我们的ID按递增的顺序来插入&＃xff0c;比如陆续插入8&＃xff0c;9&＃xff0c;10&＃xff0c;新的ID都只会插入到最后一个节点当中。当最后一个节点满了&＃xff0c;会裂变出新的节点。这样的插入是性能比较高的插入&＃xff0c;因为这样节点的分裂次数最少&＃xff0c;而且充分利用了每一个节点的空间。

但是&＃xff0c;如果我们的插入完全无序&＃xff0c;不但会导致一些中间节点产生分裂&＃xff0c;也会白白创造出很多不饱和的节点&＃xff0c;这样大大降低了数据库插入的性能。

方法二&＃xff1a;数据库自增主键

假设名为table的表有如下结构&＃xff1a;

id feild

35 a

每一次生成ID的时候&＃xff0c;访问数据库&＃xff0c;执行下面的语句&＃xff1a;

begin;

REPLACE INTO table ( feild ) VALUES ( &＃39;a&＃39; );

SELECT LAST_INSERT_ID();

commit;

REPLACE INTO 的含义是插入一条记录&＃xff0c;如果表中唯一索引的值遇到冲突&＃xff0c;则替换老数据。

这样一来&＃xff0c;每次都可以得到一个递增的ID。

为了提高性能&＃xff0c;在分布式系统中可以用DB proxy请求不同的分库&＃xff0c;每个分库设置不同的初始值&＃xff0c;步长和分库数量相等&＃xff1a;

这样一来&＃xff0c;DB1生成的ID是1,4,7,10,13....&＃xff0c;DB2生成的ID是2,5,8,11,14.....

推荐阅读

random
MybatisPlus入门系列(13) MybatisPlus之自定义ID生成器

数据库ID生成策略在数据库表设计时，主键ID是必不可少的字段，如何优雅的设计数据库ID，适应当前业务场景，需要根据需求选取 ... [详细]

蜡笔小新 2023-10-16 16:58:54
random
Android开发笔记：使用Picasso加载网络图片等比例缩放

在Android开发中，使用Picasso库可以实现对网络图片的等比例缩放。本文介绍了使用Picasso库进行图片缩放的方法，并提供了具体的代码实现。通过获取图片的宽高，计算目标宽度和高度，并创建新图实现等比例缩放。 ... [详细]

蜡笔小新 2023-12-14 17:34:00
random
[译]技术公司十年经验的职场生涯回顾

本文是一位在技术公司工作十年的职场人士对自己职业生涯的总结回顾。她的职业规划与众不同，令人深思又有趣。其中涉及到的内容有机器学习、创新创业以及引用了女性主义者在TED演讲中的部分讲义。文章表达了对职业生涯的愿望和希望，认为人类有能力不断改善自己。 ... [详细]

蜡笔小新 2023-12-14 11:31:05
random
AstridDAO 专访：波卡稳定币黑马 BAI

加入Pol ... [详细]

蜡笔小新 2023-10-17 18:14:14
random
【珍藏】2019年最新Vue相干佳构开源项目库汇总

媒介本文的前身是源自github上的项目awesome-github-vue,但由于该项目上次更新时候为2017年6月12日，许多内容早已逾期或是许多近期优异组件未被收录，所以小肆 ... [详细]

蜡笔小新 2023-10-17 14:33:46
random
sklearn数据集库中的常用数据集类型介绍

本文介绍了sklearn数据集库中常用的数据集类型，包括玩具数据集和样本生成器。其中详细介绍了波士顿房价数据集，包含了波士顿506处房屋的13种不同特征以及房屋价格，适用于回归任务。 ... [详细]

蜡笔小新 2023-12-13 17:45:15
export
MPLS VP恩后门链路shamlink实验及配置步骤

本文介绍了MPLS VP恩后门链路shamlink的实验步骤及配置过程，包括拓扑、CE1、PE1、P1、P2、PE2和CE2的配置。详细讲解了shamlink实验的目的和操作步骤，帮助读者理解和实践该技术。 ... [详细]

蜡笔小新 2023-12-12 00:07:58
byte
android studio生成jks,android studio生成 keystore 以及获取 SHA1值等

合并列值－合并为一列问题需求：createtabletab(Aint,Bint,Cint)inserttabselect1,2,3unionallsel ... [详细]

蜡笔小新 2023-12-11 12:32:55
byte
gym102222KVertex Covers（高维前缀和，meet in the middle）相关的知识介绍及解题思路

本文主要介绍了gym102222KVertex Covers（高维前缀和，meet in the middle）相关的知识，包括题意、思路和解题代码。题目给定一张n点m边的图，点带点权，定义点覆盖的权值为点权之积，要求所有点覆盖的权值之和膜qn小于等于36。文章详细介绍了解题思路，通过将图分成两个点数接近的点集L和R，并分别枚举子集S和T，判断S和T能否覆盖所有内部的边。文章还提到了使用位运算加速判断覆盖和推导T'的方法。最后给出了解题的代码。 ... [详细]

蜡笔小新 2023-12-09 10:03:53
byte
拆点+KM，建图思路看的题解，求解最小权匹配问题

本文介绍了一种求解最小权匹配问题的方法，使用了拆点和KM算法。通过将机器拆成多个点，表示加工的顺序，然后使用KM算法求解最小权匹配，得到最优解。文章给出了具体的代码实现，并提供了一篇题解作为参考。 ... [详细]

蜡笔小新 2023-12-09 09:24:15
merge
如何使用MATLAB调用摄像头进行人脸检测和识别

本文介绍了如何使用MATLAB调用摄像头进行人脸检测和识别。首先需要安装扩展工具，并下载安装OS Generic Video Interface。然后使用MATLAB的机器视觉工具箱中的VJ算法进行人脸检测，可以直接调用CascadeObjectDetector函数进行检测。同时还介绍了如何调用摄像头进行人脸识别，并对每一帧图像进行识别。最后，给出了一些相关的参考资料和实例。 ... [详细]

蜡笔小新 2023-12-09 08:56:44
tree
开发笔记:源码分析ConcurrentHashMap与HashTable（JDK1.8）

本文由编程笔记#小编为大家整理，主要介绍了源码分析--ConcurrentHashMap与HashTable（JDK1.8）相关的知识，希望对你有一定的参考价值。　　Concu ... [详细]

蜡笔小新 2023-10-17 21:45:25
request
数据业务|指示_VoLTE端到端业务详解 | VoLTE用户注册流程

篇首语：本文由编程笔记#小编为大家整理，主要介绍了VoLTE端到端业务详解|VoLTE用户注册流程相关的知识，希望对你有一定的参考价值。书籍来源：艾怀丽 ... [详细]

蜡笔小新 2023-10-17 16:20:46
request
生产环境下JVM调优参数的设置实例

正文前先来一波福利推荐：福利一：百万年薪架构师视频，该视频可以学到很多东西，是本人花钱买的VIP课程，学习消化了一年，为了支持一下女朋友公众号也方便大家学习，共享给大家。福利二 ... [详细]

蜡笔小新 2023-10-17 14:08:49
request
mongodb数据迁移,程序员未来职场之路

一面自我介绍对象相等的判断，equals方法实现。可以简单描述挫折，并说明自己如何克服，最终有哪些收获。职业规划表明自己决心，首先自己不准备继续求学了，必须招工作了。希望去哪 ... [详细]

蜡笔小新 2023-10-17 13:57:50

汶汐_782

这个家伙很懒，什么也没留下！

Tags | 热门标签

RankList | 热门文章