自增ID演算法snowflake

来源:https://www.cnblogs.com/alex-bian/archive/2020/03/19/12524041.html
-Advertisement-
Play Games

使用UUID或者GUID產生的ID沒有規則 Snowflake演算法是Twitter的工程師為實現遞增而不重覆的ID實現的 概述 分散式系統中,有一些需要使用全局唯一ID的場景,這種時候為了防止ID衝突可以使用36位的UUID,但是UUID有一些缺點,首先他相對比較長,另外UUID一般是無序的。有些時 ...


使用UUID或者GUID產生的ID沒有規則

Snowflake演算法是Twitter的工程師為實現遞增而不重覆的ID實現的

概述 
分散式系統中,有一些需要使用全局唯一ID的場景,這種時候為了防止ID衝突可以使用36位的UUID,但是UUID有一些缺點,首先他相對比較長,另外UUID一般是無序的。有些時候我們希望能使用一種簡單一些的ID,並且希望ID能夠按照時間有序生成。而twitter的snowflake解決了這種需求,最初Twitter把存儲系統從MySQL遷移到Cassandra,因為Cassandra沒有順序ID生成機制,所以開發了這樣一套全局唯一ID生成服務。 
該項目地址為:https://github.com/twitter/snowflake是用Scala實現的。 
python版詳見開源項目https://github.com/erans/pysnowflake

結構 
snowflake的結構如下(每部分用-分開):

0 - 0000000000 0000000000 0000000000 0000000000 0 - 00000 - 00000 - 000000000000

第一位為未使用,接下來的41位為毫秒級時間(41位的長度可以使用69年),然後是5位datacenterId和5位workerId(10位的長度最多支持部署1024個節點) ,最後12位是毫秒內的計數(12位的計數順序號支持每個節點每毫秒產生4096個ID序號)

一共加起來剛好64位,為一個Long型。(轉換成字元串長度為18)

snowflake生成的ID整體上按照時間自增排序,並且整個分散式系統內不會產生ID碰撞(由datacenter和workerId作區分),並且效率較高。據說:snowflake每秒能夠產生26萬個ID。

從圖上看除了第一位不可用之外其它三組均可浮動站位,據說前41位就可以支撐到2082年,10位的可支持1023台機器,最後12位序列號可以在1毫秒內產生4095個自增的ID。

在多線程中使用要加鎖。

 

看懂代碼前 先來點電腦常識:<<左移  假如1<<2  :1左移2位=1*2^2=4(這裡^是多少次方的意思,和下麵的不同,哈別混淆。)

                                                     ^異或 :true^true=false   false^false=false  true^false=true false^true=true  例子:  1001^0001=1000

  負數的二進位:

第一步:絕對值化為你需要多少位表示的二進位
第二步:各位取反,0變1,1變0
第三步:最後面加1  例子:-1的二進位→      0001  取反→1110→最後面加1→1111

好了廢話不多說 直接代碼:

 1 public class IdWorker
 2     {
 3         //機器ID
 4         private static long workerId;
 5         private static long twepoch = 687888001020L; //唯一時間,這是一個避免重覆的隨機量,自行設定不要大於當前時間戳
 6         private static long sequence = 0L;
 7         private static int workerIdBits = 4; //機器碼位元組數。4個位元組用來保存機器碼(定義為Long類型會出現,最大偏移64位,所以左移64位沒有意義)
 8         public static long maxWorkerId = -1L ^ -1L << workerIdBits; //最大機器ID
 9         private static int sequenceBits = 10; //計數器位元組數,10個位元組用來保存計數位
10         private static int workerIdShift = sequenceBits; //機器碼數據左移位數,就是後面計數器占用的位數
11         private static int timestampLeftShift = sequenceBits + workerIdBits; //時間戳左移動位數就是機器碼和計數器總位元組數
12         public static long sequenceMask = -1L ^ -1L << sequenceBits; //一微秒內可以產生計數,如果達到該值則等到下一微秒在進行生成
13         private long lastTimestamp = -1L;
14 
15         /// <summary>
16         /// 機器碼
17         /// </summary>
18         /// <param name="workerId"></param>
19         public IdWorker(long workerId)
20         {
21             if (workerId > maxWorkerId || workerId < 0)
22                 throw new Exception(string.Format("worker Id can't be greater than {0} or less than 0 ", workerId));
23             IdWorker.workerId = workerId;
24         }
25 
26         public long nextId()
27         {
28             lock (this)
29             {
30                 long timestamp = timeGen();
31                 if (this.lastTimestamp == timestamp)
32                 { //同一微秒中生成ID
33                     IdWorker.sequence = (IdWorker.sequence + 1) & IdWorker.sequenceMask; //用&運算計算該微秒內產生的計數是否已經到達上限
34                     if (IdWorker.sequence == 0)
35                     {
36                         //一微秒內產生的ID計數已達上限,等待下一微秒
37                         timestamp = tillNextMillis(this.lastTimestamp);
38                     }
39                 }
40                 else
41                 { //不同微秒生成ID
42                     IdWorker.sequence = 0; //計數清0
43                 }
44                 if (timestamp < lastTimestamp)
45                 { //如果當前時間戳比上一次生成ID時時間戳還小,拋出異常,因為不能保證現在生成的ID之前沒有生成過
46                     throw new Exception(string.Format("Clock moved backwards.  Refusing to generate id for {0} milliseconds",
47                         this.lastTimestamp - timestamp));
48                 }
49                 this.lastTimestamp = timestamp; //把當前時間戳保存為最後生成ID的時間戳
50                 long nextId = (timestamp - twepoch << timestampLeftShift) | IdWorker.workerId << IdWorker.workerIdShift | IdWorker.sequence;
51                 return nextId;
52             }
53         }
54 
55         /// <summary>
56         /// 獲取下一微秒時間戳
57         /// </summary>
58         /// <param name="lastTimestamp"></param>
59         /// <returns></returns>
60         private long tillNextMillis(long lastTimestamp)
61         {
62             long timestamp = timeGen();
63             while (timestamp <= lastTimestamp)
64             {
65                 timestamp = timeGen();
66             }
67             return timestamp;
68         }
69 
70         /// <summary>
71         /// 生成當前時間戳
72         /// </summary>
73         /// <returns></returns>
74         private long timeGen()
75         {
76             return (long)(DateTime.UtcNow - new DateTime(1970, 1, 1, 0, 0, 0, DateTimeKind.Utc)).TotalMilliseconds;
77         }
78 
79     }

調用:
1  IdWorker idworker = new IdWorker(1);
2             for (int i = 0; i < 1000; i++)
3             {
4                 Console.WriteLine(idworker.nextId());
5             }

其他演算法:

方法一:UUID

UUID是通用唯一識別碼 (Universally Unique Identifier),在其他語言中也叫GUID,可以生成一個長度32位的全局唯一識別碼。

 

String uuid = UUID.randomUUID().toString()

 

結果示例:

 

046b6c7f-0b8a-43b9-b35d-6489e6daee91

 

 

為什麼無序的UUID會導致入庫性能變差呢?

 

這就涉及到 B+樹索引的分裂

 

 

 

 

眾所周知,關係型資料庫的索引大都是B+樹的結構,拿ID欄位來舉例,索引樹的每一個節點都存儲著若幹個ID。

 

如果我們的ID按遞增的順序來插入,比如陸續插入8,9,10,新的ID都只會插入到最後一個節點當中。當最後一個節點滿了,會裂變出新的節點。這樣的插入是性能比較高的插入,因為這樣節點的分裂次數最少,而且充分利用了每一個節點的空間。

 

 

 

 

但是,如果我們的插入完全無序,不但會導致一些中間節點產生分裂,也會白白創造出很多不飽和的節點,這樣大大降低了資料庫插入的性能。

 

 

方法二:資料庫自增主鍵

 

假設名為table的表有如下結構:

 

id        feild

35        a

 

每一次生成ID的時候,訪問資料庫,執行下麵的語句:

 

begin;

REPLACE INTO table ( feild )  VALUES ( 'a' );

SELECT LAST_INSERT_ID();

commit;


REPLACE INTO 的含義是插入一條記錄,如果表中唯一索引的值遇到衝突,則替換老數據。

 

這樣一來,每次都可以得到一個遞增的ID。

 

為了提高性能,在分散式系統中可以用DB proxy請求不同的分庫,每個分庫設置不同的初始值,步長和分庫數量相等:

 

 

 

 

 

 

 

這樣一來,DB1生成的ID是1,4,7,10,13....,DB2生成的ID是2,5,8,11,14.....

 


您的分享是我們最大的動力!

-Advertisement-
Play Games
更多相關文章
  • Android手機測試, 涉及照相機(Camera)應用程式的穩定性測試的用例, 需要涉及100張照片的拍照自動化測試。 準備階段 1. 先清理老照片,照片一般存放在/scard/DCIM目錄下 2. adb shell am start + 相機的Activity 可以打開相機App 3. adb ...
  • https://www.cnblogs.com/jager/p/4344216.html https://www.cnblogs.com/zhenyuyaodidiao/p/4755649.html ...
  • 01-多線程的引入 如果程式只有一條執行路徑,那麼該程式就是單線程程式 如果程式有多條執行程式,那麼該程式就是多線程程式 02-進程概述及多進程的意義 要想瞭解多線程,必須先瞭解線程,而要想瞭解線程,必須先瞭解進程,因為線程是依賴於進程而存在。 進程:就是正在運行的程式。 進程是系統進行資源分配和調 ...
  • @2020.3.19 # 作業要求:下述所有代碼畫圖以及分析代碼執行流程# 1、以定義階段為準,先畫出名稱空間的嵌套關係圖# 2、然後找到調用函數的位置,寫出函數調用時代碼的執行過程,涉及到名字的查找時,參照1中畫好的嵌套圖,標明查找順序,一層一層直到找到位置 # 題目一 input=333 def ...
  • 前幾天微軟收購npm的新聞對於軟粉來收很是振奮。微軟收購npm很可能是為了加強Github Packages。目前Github,Typescript,VSCode,npm這些開源社區的重磅工具全部都在微軟旗下,顯示出了微軟對開源的態度,微軟已經不是以前那個封閉的微軟。Github推出Github P ...
  • 基於 Roslyn 實現一個簡單的條件解析引擎 Intro 最近在做一個勛章的服務,我們想定義一些勛章的獲取條件,滿足條件之後就給用戶頒發一個勛章,定義條件的時候會定義需要哪些參數,參數的類型,獲取勛章的時候會提供鎖需要的參數,有一些內置的參數,內置的參數解析器(ParamResolver)。 最後 ...
  • 作業:輸入某年某月某日,判斷這一天是這一年的第幾天?。要求:需寫一個函數,給定年月 日,求的該天處於該年的第幾天。然後在Main函數中測試。 思路: ①需要有兩個函數。一個主函數,一個Date函數用來計算天數。 ②在主函數裡面利用控制台輸入年月日,然後在調用Date函數. 由於調用函數了就傳值了,調 ...
  • asp.net core應用常常要通過nginx來反向代理, 普通的web api配置asp.net core反向代理比較常見, 如果在應用中集成了signalr, 如何使用nginx來反代呢? ...
一周排行
    -Advertisement-
    Play Games
  • C#TMS系統代碼-基礎頁面BaseCity學習 本人純新手,剛進公司跟領導報道,我說我是java全棧,他問我會不會C#,我說大學學過,他說這個TMS系統就給你來管了。外包已經把代碼給我了,這幾天先把增刪改查的代碼背一下,說不定後面就要趕鴨子上架了 Service頁面 //using => impo ...
  • 委托與事件 委托 委托的定義 委托是C#中的一種類型,用於存儲對方法的引用。它允許將方法作為參數傳遞給其他方法,實現回調、事件處理和動態調用等功能。通俗來講,就是委托包含方法的記憶體地址,方法匹配與委托相同的簽名,因此通過使用正確的參數類型來調用方法。 委托的特性 引用方法:委托允許存儲對方法的引用, ...
  • 前言 這幾天閑來沒事看看ABP vNext的文檔和源碼,關於關於依賴註入(屬性註入)這塊兒產生了興趣。 我們都知道。Volo.ABP 依賴註入容器使用了第三方組件Autofac實現的。有三種註入方式,構造函數註入和方法註入和屬性註入。 ABP的屬性註入原則參考如下: 這時候我就開始疑惑了,因為我知道 ...
  • C#TMS系統代碼-業務頁面ShippingNotice學習 學一個業務頁面,ok,領導開完會就被裁掉了,很突然啊,他收拾東西的時候我還以為他要旅游提前請假了,還在尋思為什麼回家連自己買的幾箱飲料都要叫跑腿帶走,怕被偷嗎?還好我在他開會之前拿了兩瓶芬達 感覺感覺前面的BaseCity差不太多,這邊的 ...
  • 概述:在C#中,通過`Expression`類、`AndAlso`和`OrElse`方法可組合兩個`Expression<Func<T, bool>>`,實現多條件動態查詢。通過創建表達式樹,可輕鬆構建複雜的查詢條件。 在C#中,可以使用AndAlso和OrElse方法組合兩個Expression< ...
  • 閑來無聊在我的Biwen.QuickApi中實現一下極簡的事件匯流排,其實代碼還是蠻簡單的,對於初學者可能有些幫助 就貼出來,有什麼不足的地方也歡迎板磚交流~ 首先定義一個事件約定的空介面 public interface IEvent{} 然後定義事件訂閱者介面 public interface I ...
  • 1. 案例 成某三甲醫預約系統, 該項目在2024年初進行上線測試,在正常運行了兩天後,業務系統報錯:The connection pool has been exhausted, either raise MaxPoolSize (currently 800) or Timeout (curren ...
  • 背景 我們有些工具在 Web 版中已經有了很好的實踐,而在 WPF 中重新開發也是一種費時費力的操作,那麼直接集成則是最省事省力的方法了。 思路解釋 為什麼要使用 WPF?莫問為什麼,老 C# 開發的堅持,另外因為 Windows 上已經裝了 Webview2/edge 整體打包比 electron ...
  • EDP是一套集組織架構,許可權框架【功能許可權,操作許可權,數據訪問許可權,WebApi許可權】,自動化日誌,動態Interface,WebApi管理等基礎功能於一體的,基於.net的企業應用開發框架。通過友好的編碼方式實現數據行、列許可權的管控。 ...
  • .Net8.0 Blazor Hybird 桌面端 (WPF/Winform) 實測可以完整運行在 win7sp1/win10/win11. 如果用其他工具打包,還可以運行在mac/linux下, 傳送門BlazorHybrid 發佈為無依賴包方式 安裝 WebView2Runtime 1.57 M ...