python 3.7+字典有序是因紧凑结构中entries数组按插入顺序线性追加存储,遍历时直接顺序读取,零开销保序;旧版哈希表扩容重排导致无序。

Python 3.7+ 的字典有序不是靠“记住顺序”,而是底层存储结构本身强制按插入顺序线性排列——你往里塞一个键值对,它就老老实实追加到 entries 数组末尾,遍历时自然按这个顺序出来。
为什么旧版字典无序?哈希表扩容会打乱位置
Python 3.6 之前,字典是经典哈希表:每个 bucket 直接存 (hash, key, value),数组下标由 hash 值直接映射。问题在于:
- 哈希碰撞时要探测下一个空位,插入位置不连续
- 扩容时整个表重建,所有键重新 hash、重排位置,原有相对顺序彻底丢失
- 稀疏数组中大量
None或占位符,遍历时必须跳过,顺序不可控
所以哪怕你写 d = {'a': 1, 'b': 2},实际内存布局可能把 'b' 放在前面——这不是 bug,是设计使然。
Python 3.7+ 怎么做到“又快又有序”?双数组分离设计
关键改动是把“查找索引”和“数据存储”拆开:indices(稀疏)只存跳转地址,entries(紧凑)只按插入顺序存真实数据。
-
indices数组大小约是entries的 2–4 倍,每个元素是int8,只记录“这个 hash 槽对应entries的第几个位置” -
entries是纯线性数组,每次d[key] = value就 append 一条新记录:(hash, key, value) - 遍历
dict.items()时,CPython 直接顺序读entries,根本不用碰indices
这解释了为什么保序是零开销的:没额外链表、没排序逻辑、不改已有 entry 位置——顺序就是追加的副产品。
使用 font_manager.addfont() 添加中文字体文件,设置 rcParams['font.family'],并禁用 unicode_minus,使 matplotlib 显示中文。
json.dumps() 为什么突然可预测了?它根本不排序
json.dumps() 从不主动重排字段;它只是忠实调用 dict.__iter__(),而这个迭代器在 3.7+ 中返回的就是 entries 的线性顺序。
- 写
json.dumps({'c': 3, 'a': 1, 'b': 2}),输出永远是{"c": 3, "a": 1, "b": 2}(前提是没设sort_keys=True) - 如果你手动构造配置字典,前端依赖字段顺序渲染表单,这个行为现在完全可靠
- diff 工具能稳定比对 JSON 文件变更,因为字段顺序不再随 Python 版本或运行环境抖动
别再条件反射 import OrderedDict ——除非你需要 move_to_end() 或 popitem(last=False) 这类操作,否则普通 dict 就是更轻、更快、更标准的解法。
容易被忽略的边界点:保序 ≠ 可排序,删除也不重排
字典的“有序”严格限定为插入顺序:
-
del d['x']后,剩余项顺序不变,但entries中对应位置会被标记为DKIX_DUMMY,不立即压缩——所以插入新键仍追加在末尾,不会插进空洞 -
sorted(d.keys())返回的是字典序,跟插入顺序无关;list(d.keys())才是插入顺序 - 如果用
**kwargs接收参数,其内部字典也遵循该规则,但函数定义顺序才是插入顺序源头
真正要注意的,是那些你以为“应该有序”但其实没走字典路径的地方:比如 vars(obj) 返回的字典虽有序,但类属性定义顺序受 __dict__ 构建时机影响,不能简单等同于源码书写顺序。
Python免费学习笔记(深入):立即使用
在学习笔记中,你将探索 Python 的核心概念和高级技巧!










