prometheus可直接采集hermes agent暴露的指标端点数据以实现可观测性管理,需依次启用其metrics功能、配置prometheus抓取任务、验证数据接入、集成cadvisor补充容器指标,并通过grafana可视化呈现。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

如果您希望对Hermes Agent运行状态实施持续可观测性管理,Prometheus可直接采集其暴露的指标端点数据。以下是完成集成的具体操作步骤:
一、启用Hermes Agent的Prometheus指标暴露
Hermes Agent的MLOps模块(如vLLM服务)已原生支持Prometheus格式指标输出,需在启动时显式开启。该步骤确保指标端点可被外部抓取。
1、确认Hermes Agent服务使用vLLM作为后端推理引擎。
2、在启动命令中添加--enable-metrics参数以启用指标导出功能。
3、指定监控端口,例如使用--metrics-port 9090将指标暴露在本地9090端口。
4、执行完整启动命令示例:
vllm serve meta-llama/Llama-3-8B-Instruct --enable-metrics --metrics-port 9090
二、配置Prometheus抓取目标
Prometheus需明确知晓从何处拉取Hermes Agent的指标数据,通过修改其主配置文件prometheus.yml,定义抓取任务与目标地址。
1、打开或创建Prometheus配置文件prometheus.yml。
2、在scrape_configs段落中新增名为hermes-agent的任务条目。
3、设置static_configs下的targets为['localhost:9090'](若部署在远程主机,请替换为对应IP和端口)。
4、显式指定metrics_path为/metrics,确保路径匹配Hermes Agent默认暴露路径。
5、设置抓取间隔为15s,以平衡实时性与系统开销。
三、启动并验证Prometheus服务
配置完成后,Prometheus需重新加载配置并建立与Hermes Agent指标端点的连接,验证是否成功获取数据是关键确认环节。
1、在终端中执行prometheus --config.file=prometheus.yml启动服务。
2、访问Prometheus Web界面(默认地址:http://localhost:9090)。
3、点击“Status” → “Targets”,检查hermes-agent任务状态是否显示为UP。
4、在表达式输入框中键入vllm_request_success_total并执行查询,确认返回非空时间序列数据。
四、集成cAdvisor补充容器级指标
除Hermes Agent自身业务指标外,还需采集底层容器运行时资源消耗数据,cAdvisor可提供CPU、内存、网络、磁盘I/O等维度的细粒度指标,与Prometheus协同构成完整监控栈。
1、以Docker方式启动cAdvisor容器,映射主机端口8080:
docker run -d --name=cadvisor -p 8080:8080 --privileged --volume=/:/rootfs:ro --volume=/var/run:/var/run:rw --volume=/sys:/sys:ro --volume=/var/lib/docker/:/var/lib/docker:ro gcr.io/cadvisor/cadvisor:v0.49.1
2、编辑prometheus.yml,在scrape_configs中追加新任务:
- job_name: 'cadvisor'
static_configs:
- targets: ['localhost:8080']
3、重启Prometheus使配置生效。
4、在Prometheus界面中查询container_cpu_usage_seconds_total,确认cAdvisor指标已成功接入。
五、配置Grafana数据源与基础仪表板
Grafana作为可视化层,需连接已运行的Prometheus实例,并加载预定义或自建面板以呈现Hermes Agent核心指标。
1、启动Grafana服务(默认监听端口3000)。
2、浏览器访问http://localhost:3000,使用默认凭据(admin/admin)登录。
3、进入“Configuration” → “Data Sources” → “Add data source”,选择Prometheus类型。
4、在URL字段填入Prometheus服务地址,例如:http://host.docker.internal:9090(Windows/macOS Docker Desktop)或http://localhost:9090(Linux直连)。
5、点击“Save & Test”,确认连接状态为Data source is working。
6、导入推荐仪表板:访问Grafana Dashboards网站,搜索ID为18608(vLLM官方仪表板)或手动创建新面板,添加PromQL查询:
rate(vllm_request_success_total[5m])用于请求成功率图表。











