Prometheus 怎么处理高基数带来的性能下降

风萱同学_5305

风萱同学_5305

2026-08-23

872人浏览

原创

核心是阻止高基数数据进入内存,通过采集、写入、查询三环节拦截:先定位爆炸源头(查序列数、指标分布、危险标签),再源头裁剪(labeldrop、路径归一化、禁用元标签),接着预聚合(recording rules),最后加限制兜底(max-series、admin api、exporter改造)。

prometheus 怎么处理高基数带来的性能下降

核心是不让高基数数据进内存——在采集、写入、查询三个环节层层拦截,而不是等它进来再“救火”。

先定位爆炸源头

别猜,直接查指标和标签的实际分布:

  • 看总序列数是否持续上涨:查 prometheus_tsdb_head_series,确认 Head Block 是否在“膨胀”
  • 统计各指标的序列数量:用 count by (__name__) ({__name__=~".+"}) 找出前几名“大户”
  • 盯住危险标签值:比如 label_values(http_request_duration_seconds_bucket, url),如果返回几千个 URL,基本就是问题所在
  • 特别留意 user_id、request_id、trace_id、动态 path(如 /api/users/12345) 这类无界标签

从源头裁剪标签

让高基数标签根本不出现在时间序列里:

HTML5主机托管服务公司网站模板
HTML5主机托管服务公司网站模板

HTML5主机托管服务公司网站模板是一款从事主机托管服务公司宣传网站模板下载。提示:本模板调用到谷歌字体库,可能会出现页面打开比较缓慢。

下载
  • labeldrop 直接丢弃:在 scrape_configs 的 relabel_configs 中写 - action: labeldrop; source_labels: [url][user_id]
  • 对必须保留的路径做归一化:用正则把 /api/v1/orders/789/api/v1/orders/:id,再用 labelmapreplacement 覆盖原标签
  • 禁用默认元数据标签:如 __meta_kubernetes_pod_uid__meta_kubernetes_pod_ip,除非业务明确依赖

用 recording rules 预聚合替代原始查询

不查爆炸性原始指标,只查聚合后结果:

  • http_requests_total{method, status, url} 拆成两层:一层按 job, method, status 聚合(低基数),另一层只保留关键白名单 URL(如 /health/login
  • 定义 recording rule:job:http_requests_total:rate5m = sum by (job, method, status) (rate(http_requests_total[5m]))
  • 所有告警、看板、下游系统都基于这类聚合指标,原始高基数指标可设为 drop 或仅短期保留用于调试

加限制和兜底机制

防漏网之鱼引发雪崩:

  • 启动时加参数:--storage.tsdb.max-series-per-metric=50000,超限自动拒绝写入
  • 启用 admin API(--web.enable-admin-api),配合脚本定期调用 /api/v1/admin/tsdb/delete_series 清理已确认废弃的系列(注意指定时间范围,慎用)
  • 对 exporter 做改造:比如 Kafka exporter 等,从源头控制暴露的标签维度和取值范围
数码产品性能查询
数码产品性能查询

该软件包括了市面上所有手机CPU,手机跑分情况,电脑CPU,电脑产品信息等等,方便需要大家查阅数码产品最新情况,了解产品特性,能够进行对比选择最具性价比的商品。

下载

相关标签:

本站声明:本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

相关专题

更多
PHP 命令行脚本与自动化任务开发
PHP 命令行脚本与自动化任务开发

本专题系统讲解 PHP 在命令行环境(CLI)下的开发与应用,内容涵盖 PHP CLI 基础、参数解析、文件与目录操作、日志输出、异常处理,以及与 Linux 定时任务(Cron)的结合使用。通过实战示例,帮助开发者掌握使用 PHP 构建 自动化脚本、批处理工具与后台任务程序 的能力。

2025.12.13

426

14

Figma AI自动化智能数据填充与交互生成实战
Figma AI自动化智能数据填充与交互生成实战

告别机械重复,详细演示如何用 AI 填充业务真实数据,并自动为页面添加交互连线,将静态设计稿快速转变为动态原型。

2026.05.13

245

17

Vibeknow在线使用入口合集
Vibeknow在线使用入口合集

本专题汇总了Vibeknow在线创作视频的官方入口及网页版使用教程,涵盖PPT、PDF、Word等文档一键转讲解视频的核心操作,并整理了免费版水印规则与手机端浏览器访问指南,助你快速将知识内容视频化。

2026.09.21

0

20

NumPy随机数文件读写与dtype数据类型
NumPy随机数文件读写与dtype数据类型

本专题整理 NumPy 随机数、文件读写与 dtype 数据类型相关教程,覆盖 Generator/random、随机数种子、正态分布采样、npy/npz/CSV/TXT 保存读取、loadtxt/savetxt、memmap、大文件处理、astype 类型转换、结构化 dtype、整数溢出和精度丢失等场景。

2026.09.21

0

24

NumPy矩阵运算与线性代数计算
NumPy矩阵运算与线性代数计算

本专题整理 NumPy 矩阵运算与线性代数计算相关教程,覆盖矩阵乘法、dot 与 @ 运算符、逆矩阵、行列式、特征值与特征向量、SVD、线性方程组、欧氏距离、矩阵分解和大规模矩阵性能优化等内容,帮助读者掌握 np.linalg 与矩阵计算实战。

2026.09.21

0

20

NumPy广播机制数学运算与统计分析
NumPy广播机制数学运算与统计分析

本专题整理 NumPy 广播机制、数组数学运算与统计分析相关教程,覆盖广播规则、维度对齐、矩阵与数组加减除法、向量化计算、均值方差、分位数、中位数、直方图和 unique 频次统计等场景,帮助读者掌握 ndarray 高效计算与统计处理方法。

2026.09.21

0

17

NumPy数组创建索引切片与数据选择
NumPy数组创建索引切片与数据选择

本专题整理 NumPy 数组创建、索引、切片与数据选择相关教程,覆盖 np.array、zeros/ones、多维数组形状、基础切片、花式索引、布尔索引、条件筛选、视图与副本等常用场景,帮助读者系统掌握 ndarray 数据构造与高效提取方法。

2026.09.21

0

12

Aionclaw智能助手介绍
Aionclaw智能助手介绍

本专题汇总了AionClaw(AI龙虾助手)的功能介绍与在线使用入口。AionClaw是杭州趣猿人工智能有限公司推出的桌面级AI智能体,能直接在电脑上读写文件、运行脚本、操作浏览器,自动交付Word、PPT、Excel等成品。

2026.09.20

20

13

AionClaw AI智能体与电脑自动化任务执行功能使用教程
AionClaw AI智能体与电脑自动化任务执行功能使用教程

AionClaw专题整理AI智能体与电脑自动化相关功能使用教程,涵盖安装部署、AI任务执行、Skills技能、文件处理、浏览器控制、电脑操作、持久记忆、聊天工具连接以及办公、编程和内容创作等功能,帮助用户快速掌握AionClaw的实际使用方法。

2026.09.20

0

15

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
phpMyAdmin 配置文档
phpMyAdmin 配置文档

共0课时 | 0人学习

Swoole手册
Swoole手册

共0课时 | 0人学习