blackbox_tcp |
1.72s ago |
535.5us |
||
| Rule | State | Error | Last Evaluation | Evaluation Time |
| alert: BlackboxTCPFailure expr: probe_success == 0 for: 1m labels: severity: critical annotations: description: 'Blackbox TCP probe to {{ $labels.instance }} (service: {{ $labels.service }}) failed.' summary: TCP connectivity failed for {{ $labels.instance }} | ok | 1.72s ago | 519.8us | |
extra-checks |
12.192s ago |
603.7us |
||
| Rule | State | Error | Last Evaluation | Evaluation Time |
| alert: ServiceDoesNotExist expr: service_exists == 0 for: 1m labels: severity: critical annotations: description: Systemd service '{{ $labels.service }}' is missing on instance {{ $labels.instance }}. summary: Service {{ $labels.service }} does NOT exist | ok | 12.192s ago | 398.1us | |
| alert: DotnetMissing expr: dotnet_exists == 0 for: 1m labels: severity: critical annotations: description: .NET runtime is NOT installed on instance {{ $labels.instance }}. summary: .NET runtime missing | ok | 12.192s ago | 191.5us | |
nginx_alerts |
7.449s ago |
486.6us |
||
| Rule | State | Error | Last Evaluation | Evaluation Time |
| alert: NginxExporterDown expr: up{job="nginx"} == 0 for: 1m labels: severity: critical annotations: description: Prometheus cannot scrape NGINX metrics. summary: 'NGINX exporter down: {{ $labels.instance }}' | ok | 7.449s ago | 358.6us | |
| alert: NginxHighConnections expr: nginx_connections_active > 1000 for: 2m labels: severity: warning annotations: description: Active connections > 1000 for 2 minutes. summary: High NGINX connections on {{ $labels.instance }} | ok | 7.448s ago | 108.5us | |
node_exporter_alerts |
208ms ago |
7.045ms |
||
| Rule | State | Error | Last Evaluation | Evaluation Time |
| alert: HighCPUUsage expr: (100 - avg by (instance) (irate(node_cpu_seconds_total{mode="idle"}[5m])) * 100) > 90 for: 5m labels: severity: warning annotations: description: CPU usage is above 90% for 5 minutes. summary: High CPU usage on {{ $labels.instance }} | ok | 208ms ago | 3.647ms | |
| alert: HighMemoryUsage expr: (1 - (node_memory_MemAvailable_bytes / node_memory_MemTotal_bytes)) * 100 > 90 for: 5m labels: severity: warning annotations: description: Memory usage is above 90%. summary: High memory usage on {{ $labels.instance }} | ok | 205ms ago | 1.112ms | |
| alert: HighDiskUsage expr: 100 * (1 - node_filesystem_avail_bytes{fstype!~"tmpfs|overlay",job="node_exporter",mountpoint!~"/run.*|/var/lib/docker.*"} / node_filesystem_size_bytes{fstype!~"tmpfs|overlay",job="node_exporter",mountpoint!~"/run.*|/var/lib/docker.*"}) > 90 for: 10m labels: severity: warning annotations: description: Filesystem {{ $labels.device }} mounted at {{ $labels.mountpoint }} is over 90% full. summary: Disk usage high on {{ $labels.instance }} ({{ $labels.mountpoint }}) | ok | 204ms ago | 1.863ms | |
| alert: NodeDown expr: up{job="node_exporter"} == 0 for: 2m labels: severity: critical annotations: description: Node exporter is not reachable. summary: 'Node down: {{ $labels.instance }}' | ok | 202ms ago | 402.7us | |
rabbitmq_alerts |
2.909s ago |
653.2us |
||
| Rule | State | Error | Last Evaluation | Evaluation Time |
| alert: RabbitMQExporterDown expr: up{job="rabbitmq"} == 0 for: 2m labels: severity: critical annotations: description: Prometheus cannot scrape RabbitMQ metrics. summary: 'RabbitMQ exporter down: {{ $labels.instance }}' | ok | 2.909s ago | 381.7us | |
| alert: RabbitMQUnackedMessages expr: rabbitmq_queue_messages_unacked > 100 for: 5m labels: severity: warning annotations: description: Queue {{ $labels.queue }} has {{ $value }} unacked messages. summary: Unacked messages high on {{ $labels.instance }} | ok | 2.909s ago | 142.4us | |
| alert: RabbitMQQueueTooLarge expr: rabbitmq_queue_messages_ready > 500 for: 5m labels: severity: warning annotations: description: Queue {{ $labels.queue }} has {{ $value }} ready messages. summary: Queue backlog on {{ $labels.instance }} | ok | 2.909s ago | 100.4us | |
service_status |
14.653s ago |
493.1us |
||
| Rule | State | Error | Last Evaluation | Evaluation Time |
| alert: AnyServiceDown expr: service_running == 0 for: 1m labels: severity: critical annotations: description: Service {{ $labels.service }} is not running on {{ $labels.instance }}. summary: Service {{ $labels.service }} is DOWN on {{ $labels.instance }} | ok | 14.654s ago | 474.8us | |
service_status |
9.978s ago |
402.1us |
||
| Rule | State | Error | Last Evaluation | Evaluation Time |
| alert: SystemdServiceDown expr: node_systemd_unit_state{name=~"report.service",state!="active"} == 1 for: 1m labels: severity: critical annotations: description: Service {{ $labels.name }} has been reported as not running on {{ $labels.instance }}. summary: Service {{ $labels.name }} is DOWN on {{ $labels.instance }} | ok | 9.978s ago | 390.6us | |
service_status |
5.849s ago |
314.6us |
||
| Rule | State | Error | Last Evaluation | Evaluation Time |
| alert: AnyServiceDown expr: service_running == 0 for: 30s labels: severity: critical annotations: description: Service {{ $labels.service }} has been reported as not running on {{ $labels.instance }}. summary: Service {{ $labels.service }} is DOWN on {{ $labels.instance }} | ok | 5.849s ago | 282.6us | |