用grok-status命令可快速检查grok服务状态:需v2026.2.9+版本且代理监听localhost:8080,执行grok-status --format ascii --timeout 5s输出模型名、状态码、延迟、队列长度和负载百分比;超1200ms或503即降级。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你想在终端里快速确认Grok服务是否正常运行、有没有卡顿或超载,而不是反复刷新网页状态页或翻日志文件。
用 grok-status 命令直接查状态
确保你已安装 grok-cli-skills v2026.2.9 或更高版本(执行 grok-version 验证),且本地 Grok 代理服务正在监听默认端口 【http://localhost:8080】。
运行以下命令:
grok-status --format ascii --timeout 5s
该命令会向本地 Grok 代理发起健康检查请求,并以 ASCII 表格形式输出模型名称、HTTP 状态码、响应延迟、当前队列长度和专家负载百分比。
若返回 HTTP 503 或延迟超过 【1200ms】,说明服务已降级或不可用;此时不要继续提交推理请求,避免触发重试风暴。
无 CLI 工具时的替代方案
方法一:用 curl + jq 快速提取关键指标
执行:curl -s http://localhost:8080/health | jq '.status, .latency_ms, .queue_length, .expert_load_pct'
注意:此路径仅在 telemetry.metrics.enabled: true 且服务启用了健康端点时有效。如果返回空或 404,请先检查 config.yaml 中是否开启 health_endpoint: true。
方法二:绕过代理直查指标接口(需 Prometheus exporter 正常运行)
执行:curl -s http://localhost:9090/metrics | grep -E "(up|grok_model_latency_seconds|grok_queue_length|grok_expert_load)" | head -n 5
这条命令会从指标暴露端口抓取原始 Prometheus 数据,过滤出最相关的 5 行。其中 up 1 表示服务存活,grok_model_latency_seconds 的 quantile="0.95" 值反映长尾延迟。
把状态变成每秒刷新的实时仪表盘
第一步:创建一个临时脚本 watch-grok.sh
第二步:写入内容:#!/bin/sh\necho "GROK STATUS — $(date)\n$(grok-status --format compact)"; sleep 0.8
第三步:赋予执行权限:chmod +x watch-grok.sh
第四步:用 watch 循环执行:watch -n 1 ./watch-grok.sh
这会在终端全屏显示滚动更新的状态行,刷新间隔严格控制在 1 秒——太短会压垮本地指标接口,太长则失去实时性。watch 默认使用 Ctrl+C 退出,无需额外清理进程。











