prometheus监控系统搭建核心是启动server并拉取目标数据:先下载二进制包、配置prometheus.yml、前台启动验证;再部署node exporter并新增抓取job,确保/targets中状态为up;最后可扩展服务发现、接入业务指标,并配套grafana、alertmanager等组件实现完整监控。

搭建 Prometheus 监控系统核心就两件事:跑起来 Prometheus Server,再让它能拉到目标节点的数据。不依赖复杂编排,从零开始也能在 10 分钟内验证通路。
一、快速启动 Prometheus Server
下载官方二进制包解压即用,无需编译:
- 去 Prometheus 官网 下载最新 Linux 版本(如
prometheus-2.47.2.linux-amd64.tar.gz),解压到/usr/local/prometheus - 确保配置文件
prometheus.yml存在且路径正确,最简内容如下:
global: scrape_interval: 15s scrape_configs: - job_name: 'prometheus' static_configs: - targets: ['localhost:9090']
- 手动前台启动验证:
./prometheus --config.file=prometheus.yml --web.listen-address=:9090 --storage.tsdb.path=./data - 看到日志输出 Server is ready to receive web requests 后,访问
http://localhost:9090/targets,确认prometheus这个 job 显示 UP - 常见卡点:
• 防火墙拦截 9090 端口(sudo firewall-cmd --add-port=9090/tcp --permanent && sudo firewall-cmd --reload)
•./data目录没创建或权限不对(mkdir data && chmod 755 data)
二、让 Prometheus 拉取节点指标(以 Node Exporter 为例)
Node Exporter 是采集 Linux 主机基础指标(CPU、内存、磁盘等)的标准组件,需单独部署:
一款AI音频处理工具,主要用于MiniMax统一媒体生成技能,用于TokenPlan工作流。当用户要求生成音频、语音、TTS、旁白、图片、插图、姿势等媒体内容时使用,适合需要提升相关任务效率的用户。
- 在目标服务器上下载并运行 Node Exporter:
wget https://github.com/prometheus/node_exporter/releases/download/v1.6.1/node_exporter-1.6.1.linux-amd64.tar.gztar xzf node_exporter-*.tar.gz && cd node_exporter-*./node_exporter & - 验证服务是否就绪:
curl -s http://localhost:9100/metrics | head -n 3能返回文本说明已正常监听 - 修改
prometheus.yml,新增一个抓取 job:
- job_name: 'node' static_configs: - targets: ['目标服务器IP:9100']
- 重启 Prometheus(或发送 SIGHUP 重载配置),回到
/targets页面,确认nodejob 状态为 UP - 若始终 DOWN,优先排查:
• Node Exporter 是否真在运行(ps aux | grep node_exporter)
• 网络是否可达(telnet 目标IP 9100或nc -zv 目标IP 9100)
• 目标服务器防火墙是否放行 9100 端口
三、扩展采集:支持自动发现与业务指标
静态写 IP 适合测试;生产环境建议用服务发现或暴露自定义指标:
- 对 Kubernetes 集群,用
kubernetes_sd_configs自动发现节点、Pod 或 Service,无需硬编码地址 - 业务应用接入:在代码中引入
prometheus-client库(如 Java 的simpleclient_spring_boot),暴露/actuator/prometheus或/metrics接口 - 配置对应 job,例如:
- job_name: 'my-app' metrics_path: '/actuator/prometheus' static_configs: - targets: ['app-service:8080']
- 若应用部署在 K8s 中,可配合
ServiceMonitorCRD 实现声明式自动注册
四、配套建议:让监控真正可用
单有 Prometheus 不够,几个关键配套动作建议同步做:
-
Grafana:下载解压后配置数据源指向
http://prometheus-server-ip:9090,导入现成 Dashboard(如 Node Exporter Full)快速可视化 -
Alertmanager:单独部署,配置邮件或企业微信 Webhook,把告警规则写进
alert_rules.yml并在prometheus.yml中加载 - 长期存储:单机默认本地存储,数据量大时建议对接 Thanos 或远程写入 VictoriaMetrics 等
-
权限与维护:用 systemd 管理进程,创建专用用户(
prometheus),目录权限严格匹配,避免 root 运行










