Prometheus+Grafana监控体系搭建

孙前端

· 阅读 1261

分享
Prometheus Grafana监控

Prometheus+Grafana监控体系搭建

监控是运维的基石。没有监控的系统就像在黑暗中开车——你不知道什么时候会撞墙。Prometheus + Grafana是目前最流行的开源监控方案,支持数据采集、存储、查询、可视化、告警的全链路能力。

架构概览

Prometheus负责数据采集和存储。它通过HTTP协议定期从目标机器拉取(Pull模式)指标数据。Grafana负责可视化,连接Prometheus作为数据源,创建丰富的仪表盘。Alertmanager负责告警,接收Prometheus的告警规则触发通知。

部署方案

使用Docker Compose快速部署:Prometheus(端口9090)+ Grafana(端口3000)+ Alertmanager(端口9093)+ Node Exporter(采集主机指标,端口9100)。

prometheus.yml配置:定义scrape_interval(采集间隔,建议15s)、scrape_configs(采集目标)。添加Node Exporter作为第一个采集目标。

常用Exporter

  • Node Exporter:采集Linux主机的CPU、内存、磁盘、网络指标
  • MySQL Exporter:采集MySQL的性能指标(QPS、连接数、慢查询)
  • Redis Exporter:采集Redis的内存、连接、命中率等
  • Nginx Exporter:采集Nginx的请求量、响应时间、连接状态
  • Blackbox Exporter:探测HTTP/TCP/ICMP的可用性和响应时间
  • cAdvisor:采集Docker容器的资源使用指标

Grafana仪表盘

Grafana社区提供了大量现成的Dashboard模板。在Grafana → Import中输入模板ID即可导入。推荐模板:Node Exporter Full(ID: 1860)、MySQL Overview(ID: 7362)。

告警配置

在Prometheus中定义告警规则(alerting rules),如CPU使用率超过90%持续5分钟。Alertmanager接收告警后,根据路由配置发送到钉钉、邮件、Slack等渠道。支持告警分组、抑制、静默等高级功能。