perf(observability): reducir RAM de Prometheus

- drop de etcd_* y workqueue_* buckets en el job apiserver (en microk8s
  llegan via apiserver, no via kubeEtcd que no tiene target) -> ~90k series menos
- retention 10d -> 5d
- anadir requests/limits (700Mi/1500Mi) para acotar el uso

Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
Claude-Session: https://claude.ai/code/session_011mSH96vrGgdaxj5AKuEUAq
This commit is contained in:
2026-07-22 20:15:45 +00:00
parent 9321c6e4e8
commit 9b993f0642
+10 -1
View File
@@ -40,9 +40,11 @@ grafana:
kubeApiServer:
serviceMonitor:
metricRelabelings:
# En microk8s no hay etcd standalone: los etcd_* y workqueue_* buckets se exponen
# a traves del propio apiserver, por eso hay que dropearlos AQUI (no en kubeEtcd).
- action: drop
sourceLabels: [__name__]
regex: apiserver_request_duration_seconds_bucket|apiserver_request_sli_duration_seconds_bucket|apiserver_request_body_size_bytes_bucket|apiserver_response_sizes_bucket|apiserver_watch_list_duration_seconds_bucket|apiserver_watch_cache_read_wait_seconds_bucket|apiserver_watch_events_sizes_bucket|apiserver_admission_controller_admission_duration_seconds_bucket|apiserver_admission_webhook_admission_duration_seconds_bucket|apiserver_flowcontrol_request_execution_seconds_bucket|apiserver_flowcontrol_request_wait_duration_seconds_bucket
regex: apiserver_request_duration_seconds_bucket|apiserver_request_sli_duration_seconds_bucket|apiserver_request_body_size_bytes_bucket|apiserver_response_sizes_bucket|apiserver_watch_list_duration_seconds_bucket|apiserver_watch_cache_read_wait_seconds_bucket|apiserver_watch_events_sizes_bucket|apiserver_admission_controller_admission_duration_seconds_bucket|apiserver_admission_webhook_admission_duration_seconds_bucket|apiserver_flowcontrol_request_execution_seconds_bucket|apiserver_flowcontrol_request_wait_duration_seconds_bucket|etcd_request_duration_seconds_bucket|etcd_disk_backend_commit_duration_seconds_bucket|etcd_disk_wal_fsync_duration_seconds_bucket|etcd_network_peer_round_trip_time_seconds_bucket|workqueue_queue_duration_seconds_bucket|workqueue_work_duration_seconds_bucket
kubeControllerManager:
endpoints:
@@ -160,6 +162,13 @@ prometheus:
prometheusSpec:
evaluationInterval: 60s
scrapeInterval: 60s
retention: 5d
resources:
requests:
cpu: 250m
memory: 700Mi
limits:
memory: 1500Mi
storageSpec:
volumeClaimTemplate:
spec: