服务器异常崩溃后sse需主动感知、可控恢复、状态可溯:监听error事件并结合readystate与id判断崩溃;禁用自动重连,采用抖动+指数退避策略;利用last-event-id实现断点续传;配合toast提示、按钮禁用与缓存展示保障体验。

服务器异常崩溃后,SSE 连接会立刻中断,前端不能依赖静默重连,而要主动感知、可控恢复、状态可溯——核心是“断开即知、重连有节、数据不丢”。
监听 error 事件并准确识别崩溃断连
服务端突然崩溃(如进程退出、OOM、未捕获异常)会导致 TCP 连接直接关闭,此时 EventSource 触发 error 事件,且 readyState 变为 0(CLOSED)。但需排除主动关闭和首次连接失败:
- 维护一个 isManuallyClosed 标志,调用 close() 前设为 true,在 error 回调中跳过提示和重连
- 若 readyState === 0 且 已成功接收过至少一条带 id 的消息(说明曾连通),就判定为服务端异常崩溃
- 若首次连接就失败(如 network error 或 502/503),则显示“连接中…”而非“正在恢复”,避免误导用户
手动接管重连:随机抖动 + 指数退避
浏览器默认 3 秒重连在集群崩溃重启时易引发重连风暴。应禁用自动重连(不设 retry 字段),改用可控逻辑:
- 首次延迟:1 秒 ± 0.5 秒(0.5–1.5s),打散客户端请求时间点
- 后续延迟按 2ⁿ 增长(2s → 4s → 8s),每次叠加 ± 当前值 50% 的随机偏移
- 设置最大重试次数(如 5 次)和上限间隔(如 30 秒),避免无限等待
- 每次重连前检查 navigator.onLine,离线时暂停重连并提示“已暂停,网络恢复后自动重试”
利用 id 和 Last-Event-ID 实现断点续传
只要服务端崩溃前已推送过带 id 的事件,浏览器会在重连请求头中自动携带 Last-Event-ID,无需前端干预:
- 服务端必须为每条事件发送严格单调递增的 id: 字段(如时间戳或自增整数)
- 重连 URL 不需手动拼接参数——浏览器自动处理;但服务端收到 Last-Event-ID 后,必须只推送 ID 严格大于该值的数据
- 若页面刷新或实例重建导致 ID 丢失,服务端应 fallback 到兜底策略:返回最近 N 条历史消息,或支持 ?since=xxx 查询参数辅助定位
UI 提示与功能降级保持体验连贯
崩溃恢复不是后台任务,而是用户可见的状态流转:
- 顶部固定 Toast 显示:“⚠️ 服务暂不可用,正在尝试恢复…”(带动态省略号),恢复后自动切换为“✅ 已恢复连接”
- 连续 3 次重连失败后,升级提示:“❌ 服务异常,请稍后重试”,并显示“立即重试”按钮,点击后重置计数器并新建 EventSource
- 禁用依赖实时数据的操作(如“发送消息”、“刷新列表”),按钮加 disabled + title="服务恢复后可用",同时保留最后缓存数据并标注“(最后更新:2分钟前)”
Java免费学习笔记:立即使用
解锁 Java 大师之旅:从入门到精通的终极指南











