Включение стека мониторинга пользовательских нагрузок

Конфигурация

Чтобы включить стек, отредактируйте ConfigMap cluster-monitoring:

oc -n openshift-monitoring edit configmap cluster-monitoring-config

Установите enableUserWorkload в true:

apiVersion: v1
kind: ConfigMap
metadata:
  name: cluster-monitoring-config
  namespace: openshift-monitoring
data:
  config.yaml: |
    enableUserWorkload: true
    prometheusK8s:
      retention: 30d
      volumeClaimTemplate:
        spec:
          storageClassName: ocs-storagecluster-ceph-rbd
          resources:
            requests:
              storage: 100Gi
    alertmanagerMain:
      volumeClaimTemplate:
        spec:
          storageClassName: ocs-storagecluster-ceph-rbd
          resources:
            requests:
              storage: 50Gi

Сохраните изменения в ConfigMap. Отслеживайте ход развёртывания стека мониторинга пользовательских нагрузок с помощью следующей команды:

oc -n openshift-user-workload-monitoring get pod
NAME                                   READY   STATUS        RESTARTS   AGE
prometheus-operator-6f7b748d5b-t7nbg   2/2     Running       0          3h
prometheus-user-workload-0             4/4     Running       1          3h
prometheus-user-workload-1             4/4     Running       1          3h
thanos-ruler-user-workload-0           3/3     Running       0          3h
thanos-ruler-user-workload-1           3/3     Running       0          3h

Теперь мы можем создать ConfigMap для настройки стека мониторинга пользовательских нагрузок в пространстве имён openshift-user-workload-monitoring.

oc create configmap user-workload-monitoring-config -n openshift-user-workload-monitoring

Затем отредактируйте этот ConfigMap:

oc -n openshift-user-workload-monitoring edit configmap user-workload-monitoring-config

Сохраните следующую конфигурацию

apiVersion: v1
kind: ConfigMap
metadata:
  name: user-workload-monitoring-config
  namespace: openshift-user-workload-monitoring
data:
  config.yaml: |
    prometheus:
      retention: 30d
      volumeClaimTemplate:
        spec:
          storageClassName: ocs-storagecluster-ceph-rbd
          resources:
            requests:
              storage: 100Gi
    thanosRuler:
      volumeClaimTemplate:
        spec:
          storageClassName: ocs-storagecluster-ceph-rbd
          resources:
            requests:
              storage: 50Gi

Для предоставления пользователям доступа к созданию объектов PrometheusRule, ServiceMonitor и PodMonitor см. [2]. Для предоставления доступа к панели управления стека мониторинга пользовательских нагрузок см. [3].