redis集群无法直接执行keys ,因该命令要求所有key位于同一slot,而集群中key分散在不同主节点;必须先通过cluster nodes筛选master节点,再逐个连接执行scan 0 match count 1000并去重汇总。

redis-cli keys * 在集群上直接报错
直接运行 redis-cli -c keys * 会失败,报错 (error) CROSSSLOT Keys in request don't hash to the same slot。因为 keys * 是全局命令,而 Redis Cluster 要求所有 key 必须落在同一 slot 才能批量操作——但 * 匹配的 key 天然分散在不同节点上。
必须逐个连接 master 节点执行 scan_iter
Redis Cluster 不支持跨节点的 keys,但每个节点单独支持 scan。正确做法是:先列出所有 master 节点,再对每个节点单独执行 scan 迭代获取 key。
- 用
redis-cli -c cluster nodes解析出所有master地址(注意过滤掉slave和fail状态) - 对每个 master 执行
redis-cli -h $ip -p $port --scan --pattern "*",加--scan避免阻塞,比keys安全 - 输出结果可能重复(相同 key 名在不同 db?不,Cluster 每个节点只负责一部分 slot,但 key 名本身无冲突;重复只发生在你手动拼接多个节点输出且没去重时)
- 建议每节点输出带前缀标识,例如:
node-192.168.1.10:7001:key:session:abc,方便后续定位
Python 脚本导出 key + value 更实用
单纯导出 key 没太大用,多数人真正需要的是 key-value 对。用 Python 的 redis.RedisCluster 无法直接调 keys(),但可以靠 scan_iter() 分节点遍历:
Redis 缓存和数据结构管理技能。通过自然语言操作 Redis,支持 String、Hash、List、Set、ZSet、Stream 等数据结构操作。当用户提到 Redis、缓存、消息队列、会话存储时使用此技能。
import redis
from redis.cluster import RedisCluster
<p>rc = RedisCluster(
startup_nodes=[{"host": "192.168.1.10", "port": 7001}],
decode_responses=True,
skip_full_coverage_check=True
)</p><p>with open("redis_export.txt", "w") as f:
for key in rc.scan_iter(match="*", count=1000):
try:
val = rc.get(key)</p><h1>注意:get() 只适用于 string 类型;其他类型需用 type() + 对应命令(如 hgetall、lrange)</h1><pre class="brush:php;toolbar:false;"> f.write(f"{key}\t{val or ''}\n")
except redis.exceptions.ResponseError as e:
# 如 key 是 hash/list/set,get 会报错,跳过或改用 type 判断
continue
关键点:scan_iter 内部已自动路由到对应节点,不用手动拆解 cluster nodes;但 get() 仅兼容 string,遇到其他类型会抛 ResponseError,得加异常处理或先 type key 判断。
导出大集群时容易卡住或漏数据
两个隐形坑:
-
scan默认每次返回 10 个 key,小集群没问题;但大数据量下建议显式设count=1000,减少往返次数;不过也不能设太大(比如 10000),否则单次响应可能超时或 OOM - 如果集群正在做 reshard 或 failover,
scan_iter可能漏掉部分 slot —— 因为它按当前 slot 映射快照执行,不是强一致性快照。生产环境导出前最好确认集群稳定,或配合redis-cli -c cluster info检查cluster_state:ok和cluster_slots_assigned是否等于 16384
别指望一次脚本跑完就万事大吉;导出几万 key 后,务必用 wc -l 和 redis-cli -c dbsize(后者不准,但可作粗略参考)交叉核对数量级是否合理。










