Java中怎么生成唯一且有序的雪花算法ID_Snowflake原理与代码实现

雨宇小哥_9689

雨宇小哥_9689

2026-03-19

983人浏览

原创

snowflake id 不严格有序,因其仅保证时间维度大致有序:同毫秒内序列号自增,但跨机器或时钟回拨会导致跳变或倒流;new snowflake(1,1)中两参数为数据中心id和机器id,合占10位、须全局唯一;时钟回拨应启用容忍机制并禁用ntp step模式;mybatis-plus的assign_snowflake默认不支持集群,需外置分配workerid。

java中怎么生成唯一且有序的雪花算法id_snowflake原理与代码实现

为什么直接用 Snowflake 生成的 ID 不一定“有序”?

很多人以为 Snowflake 天然全局递增,其实它只保证“时间维度上大致有序”,不是严格单调递增。核心原因是:同一毫秒内,序列号(sequence)从 0 开始自增,但一旦跨机器或时钟回拨,就可能出现 ID 跳变甚至倒流。

常见错误现象:SELECT id FROM table ORDER BY id DESC 查出的最新记录,偶尔比前一条小;分库分表按 ID 取模后数据分布不均;下游系统依赖“ID 大 → 时间新”做排序,结果出错。

  • 关键点:ID 的高位是时间戳(毫秒),中间是机器 ID,低位是序列号 —— 所以只要时钟没回拨、单机序列没溢出,同机器下 ID 是严格递增的
  • 但多机环境下,A 机器在 t 毫秒生成了 1234567890123456789,B 机器在 t+1 毫秒生成的 ID 可能因机器 ID 更大而远大于它,也可能因序列号极小(比如 0)而只比它大一点点 —— 这就是“大致有序”的来源
  • 如果业务强依赖严格递增(比如金融流水号),得额外加锁或改用数据库自增 + 缓存预分配,Snowflake 本身不解决这个问题

new Snowflake(1, 1) 中两个参数到底代表什么?

不同实现里参数含义容易混淆。以 Twitter 原版和主流 Java 实现(如 twitter-snowflake 或 mybatis-plus 内置)为例,new Snowflake(datacenterId, machineId) 是常见签名,但注意:

  • datacenterId 和 machineId 合起来唯一标识一台发号机器 —— 它们不是“数据中心编号”和“服务器编号”的业务含义,而是用来填充 ID 中固定长度的机器位(通常各占 5 位,共 10 位,支持最多 1024 台机器)
  • 这两个值必须在部署范围内全局不重复,否则会生成重复 ID;但也不必严格按物理位置划分,可以用 IP 哈希、配置中心分配等方式动态获取
  • 别硬编码成 new Snowflake(1, 1) 上生产 —— 所有实例都用相同 ID,等于把分布式退化成单点,序列号一溢出就崩

示例:一台服务启动时从配置中心拉取 machine.id=17,然后调用 new Snowflake(0, 17)(假设不用数据中心位,就把 datacenterId 固定为 0)。

Java Maven Code Review
Java Maven Code Review

审查Java Maven项目(ZIP压缩包或GitLab仓库URL),检查代码规范、命名、模块边界、可维护性问题以及重复代码。

下载

时钟回拨导致 Invalid System Clock 怎么办?

这是 Snowflake 最典型的线上故障:服务器时间被 NTP 同步或运维误操作向后/向前调整,导致当前时间小于上次生成 ID 用的时间戳,算法直接抛异常或阻塞等待。

  • 根本原因:为了保证单调性,Snowflake 会校验 currentTimestamp >= lastTimestamp,不满足就报 Invalid System Clock
  • 不要简单 catch 异常然后 sleep —— 如果回拨 5 秒,sleep 5 秒会导致服务卡死,且无法解决根本问题
  • 更稳妥的做法是:启用容忍机制(如 waitIfClockBackwards 配置),允许短时回拨(比如 10ms 内)自动等待;对长时回拨,应告警并人工介入,而不是静默降级
  • 生产环境务必关闭 NTP 的 step 模式(即不允许跳变),改用 slewing 模式缓慢校准;容器环境尤其要注意宿主机时间同步策略

Java 里用 MyBatis-Plus 的 IdType.ASSIGN_SNOWFLAKE 安全吗?

安全,但前提是理解它背后的默认行为 —— 它用的是 DefaultIdentifierGenerator,基于 System.currentTimeMillis() + 进程内原子计数器 + JVM 启动时随机生成的 workerId,**不支持集群多实例唯一**。

  • 问题场景:Spring Boot 多节点部署,每个节点都用 ASSIGN_SNOWFLAKE,workerId 默认由 Random 生成,大概率重复 → ID 冲突风险极高
  • 解决方案:必须重写 IdentifierGenerator,把 workerId 改成从外部获取(如 Redis 自增、ZooKeeper 顺序节点、配置中心下发)
  • 性能影响:每次生成 ID 都走一次 Redis?别这么做。推荐启动时一次性分配并缓存,后续纯内存计算 —— Snowflake 的价值就在无锁、低延迟,别自己拖慢它

真正要上生产,别图省事直接开箱即用;ID 是数据链路的基石,机器 ID 的分配逻辑必须和你的部署拓扑对齐。

Java免费学习笔记:立即使用
解锁 Java 大师之旅:从入门到精通的终极指南

相关专题

更多
java
java

Java是一个通用术语,用于表示Java软件及其组件,包括“Java运行时环境 (JRE)”、“Java虚拟机 (JVM)”以及“插件”。php中文网还为大家带了Java相关下载资源、相关课程以及相关文章等内容,供大家免费下载使用。

2023.06.15

10097

6

java正则表达式语法
java正则表达式语法

java正则表达式语法是一种模式匹配工具,它非常有用,可以在处理文本和字符串时快速地查找、替换、验证和提取特定的模式和数据。本专题提供java正则表达式语法的相关文章、下载和专题,供大家免费下载体验。

2023.07.05

7242

9

java自学难吗
java自学难吗

Java自学并不难。Java语言相对于其他一些编程语言而言,有着较为简洁和易读的语法,本专题为大家提供java自学难吗相关的文章,大家可以免费体验。

2023.07.31

6372

8

java配置jdk环境变量
java配置jdk环境变量

Java是一种广泛使用的高级编程语言,用于开发各种类型的应用程序。为了能够在计算机上正确运行和编译Java代码,需要正确配置Java Development Kit(JDK)环境变量。php中文网给大家带来了相关的教程以及文章,欢迎大家前来阅读学习。

2023.08.01

1104

3

java保留两位小数
java保留两位小数

Java是一种广泛应用于编程领域的高级编程语言。在Java中,保留两位小数是指在进行数值计算或输出时,限制小数部分只有两位有效数字,并将多余的位数进行四舍五入或截取。php中文网给大家带来了相关的教程以及文章,欢迎大家前来阅读学习。

2023.08.02

908

3

java基本数据类型
java基本数据类型

java基本数据类型有:1、byte;2、short;3、int;4、long;5、float;6、double;7、char;8、boolean。本专题为大家提供java基本数据类型的相关的文章、下载、课程内容,供大家免费下载体验。

2023.08.02

1336

5

java有什么用
java有什么用

java可以开发应用程序、移动应用、Web应用、企业级应用、嵌入式系统等方面。本专题为大家提供java有什么用的相关的文章、下载、课程内容,供大家免费下载体验。

2023.08.02

2669

5

java在线网站
java在线网站

Java在线网站是指提供Java编程学习、实践和交流平台的网络服务。近年来,随着Java语言在软件开发领域的广泛应用,越来越多的人对Java编程感兴趣,并希望能够通过在线网站来学习和提高自己的Java编程技能。php中文网给大家带来了相关的视频、教程以及文章,欢迎大家前来学习阅读和下载。

2023.08.03

19971

3

配置java环境变量
配置java环境变量

配置Java环境变量是为了让操作系统能够识别和使用Java的相关命令和功能。本专题为大家提供配置java环境变量相关文章,帮助大家解决问题。

2023.08.03

1175

8

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
dev.java 官方:Learn Java
dev.java 官方:Learn Java

共0课时 | 0人学习

Java JDBC数据库连接官方教程
Java JDBC数据库连接官方教程

共0课时 | 0人学习