docker容器健康探测应通过healthcheck指令在dockerfile中定义,使用快速返回退出码的命令(成功为0,失败为非0),推荐封装为轻量shell脚本并适配服务类型,上线前需验证状态变化。

Docker 容器健康探测脚本的核心是让容器内进程主动向 Docker 报告自身状态,而不是依赖外部轮询。Docker 本身通过 HEALTHCHECK 指令支持健康检查,你只需提供一个能快速、可靠返回退出码的命令(成功为 0,失败为非 0)。
用 HEALTHCHECK 指令定义探测逻辑
在 Dockerfile 中直接声明健康检查是最规范的做法。它会自动集成到容器生命周期中,docker ps 能直观看到 healthy/unhealthy 状态。
-
基础语法:
HEALTHCHECK [OPTIONS] CMD command -
常用选项:
--interval=30s(间隔)、--timeout=3s(单次超时)、--start-period=40s(启动宽限期)、--retries=3(连续失败次数) -
推荐写法示例(检测 Web 服务是否响应 200):
HEALTHCHECK --interval=10s --timeout=3s --start-period=40s --retries=3 \CMD curl -f http://localhost:8080/health || exit 1
编写轻量可靠的探测脚本(Shell)
复杂逻辑建议封装成独立脚本(如 /health.sh),避免命令行过长或难以维护。脚本需满足:秒级完成、不产生副作用、只依赖容器内已有工具。
MiniMax 图片理解 + 网络搜索 MCP 工具。适配 Docker 环境(极空间等),支持图片 OCR 识别、图像内容理解、网络搜索。API Key 安全存储在本地 credentials 文件,不暴露在代码中。
- 检查端口连通性:
nc -z localhost 8080 && exit 0 || exit 1 - 验证 HTTP 接口返回内容:
curl -s http://localhost:8080/ready | grep -q '"status":"ok"' && exit 0 || exit 1 - 检查关键进程是否存在:
pgrep -f "myapp.jar" > /dev/null && exit 0 || exit 1 - 注意避免使用
sleep或耗时操作;不要写日志到 stdout/stderr(可能干扰健康状态判断)
适配不同应用类型的实际写法
没有万能脚本,要按服务特性设计探测点:
-
Web/API 服务:优先用 HTTP
/health或/ready端点,返回 JSON 并校验字段 -
数据库代理或中间件:用对应客户端命令,如
redis-cli ping > /dev/null、mysql -h127.0.0.1 -P3306 -e "SELECT 1" &> /dev/null - 后台 Worker:检查本地 socket、PID 文件,或向内部队列发测试消息并确认消费
-
静态文件服务(如 Nginx):可直接
curl -I http://localhost/ | head -1 | grep "200 OK"
验证与调试技巧
健康检查容易因权限、路径、环境差异失效,上线前务必验证:
- 构建镜像后,运行容器:
docker run -d --name test-app your-image - 实时观察状态:
docker inspect --format='{{.State.Health}}' test-app - 手动执行探测命令(进入容器):
docker exec -it test-app sh -c "your-health-cmd",确认退出码和输出 - 模拟故障(如 kill 主进程),观察状态是否在
retries × interval后变为unhealthy










