API Latency (p99) Healthy
142ms
Error Rate 0.12%
0.12%
DB Connections 78%
156/200
Redis Cache Hit 94.2%
94.2%
Active Users +12%
14,892
Prometheus Targets 12/12 UP
12

Prometheus Configuration

# prometheus.yml - Aevum Encyclopedia Monitoring
global:
  scrape_interval: 15s
  evaluation_interval: 15s
  external_labels:
    cluster: aevum-prod
    region: us-east-1

scrape_configs:
  - job_name: 'aevum-api'
    static_configs:
      - targets: ['api.aevum.internal:8080']
        labels:
          service: 'encyclopedia-api'
          env: 'production'

  - job_name: 'postgres-exporter'
    static_configs:
      - targets: ['db-aevum-primary.internal:9187']

  - job_name: 'redis-exporter'
    static_configs:
      - targets: ['cache.aevum.internal:9121']

alerting:
  alertmanagers:
    - static_configs:
        - targets: ['alertmanager.aevum.internal:9093']

Active Alert Rules

Rule Name Condition (PromQL) For Severity Last Fired Status
HighAPILatency histogram_quantile(0.99, rate(http_request_duration_seconds_bucket[5m])) > 0.5 3m ⚠ Critical -- Inactive
HighErrorRate sum(rate(http_requests_total{status=~"5.."}[5m])) / sum(rate(http_requests_total[5m])) > 0.02 5m ⚠ Critical 2025-01-14 09:23 Inactive
DBConnectionPoolExhaustion pg_stat_activity_count > 180 2m ⚡ Warning 2025-01-15 11:45 Firing
CacheHitRateLow rate(redis_cache_hits_total[10m]) / rate(redis_cache_lookups_total[10m]) < 0.85 10m ⚡ Warning -- Inactive
PrometheusTargetDown up == 0 1m ℹ Info -- Inactive

Quick PromQL Queries

# Requests per second by endpoint
sum by (endpoint) (rate(http_requests_total[5m]))

# 95th percentile response time
histogram_quantile(0.95, rate(http_request_duration_seconds_bucket[5m]))

# Active database queries
pg_stat_activity_count{datname="aevum_encyclopedia"}

# Memory usage by service
container_memory_working_set_bytes{namespace="aevum-prod"}