Aller au contenu

Monitoring#

Prerequisites#

Inputs#

export GIT_PATH="$HOME/git/"
export ZONE_NAME="..."
export CLOUD_ZONE_NAME="ocb-..."

Communication sur #operations_et_incidents#

Début du démantélement de l'outillage Caascad sur ${ZONE_NAME}.

Mise en place des silences#

amtool-caascad silence add cc_prom_source="${ZONE_NAME}" obs_client="${CLOUD_ZONE_NAME} --author "Caascad Team" --duration "14d" --comment "Decom : ${ZONE_NAME}" --alertmanager.url ${ZONE_NAME}/caascad
amtool-caascad silence add cc_prom_source="${ZONE_NAME}" obs_client="${CLOUD_ZONE_NAME} --author "Caascad Team" --duration "14d" --comment "Decom : ${ZONE_NAME}" --alertmanager.url ${ZONE_NAME}/client
amtool-caascad silence add alertname="RancherClientUnreachable" target_cluster="${ZONE_NAME} --author "Caascad Team" --duration "14d" --comment "Decom : ${ZONE_NAME}" --alertmanager.url ${ZONE_NAME}/caascad
amtool-caascad silence add cc_prom_source="${ZONE_NAME}" alertname="BillingClientMetricAbsent" --author "Caascad Team" --duration "14d" --comment "Decom : ${ZONE_NAME}" --alertmanager.url infra-prd/infra-consumption

Opérations sur les clusters clients#

kswitch ${ZONE_NAME}

Monitoring#

Désinstallation des charts Kube-Prometheus-Stack / Prometheus-Operator (permet de supprimer des services dans kube-system) :

helm uninstall -n caascad-monitoring monitoring
helm uninstall -n caascad-monitoring prometheus-operator

Suppression du service caascad-prometheus-kubelet (non géré par helm, géré par Prometheus-Operator) :

kubectl delete svc -n kube-system caascad-prometheus-kubelet

Suppression du namespace caascad-monitoring :

kubectl delete ns caascad-monitoring

Logging#

Suppression du namespace caascad-logging :

kubectl delete ns caascad-logging

CRDs Prometheus-Operator#

helm uninstall -n kube-system prometheus-operator-crds

Vérifications#

kubectl get all -A | grep caascad
Résultat: aucune ligne sauf eventrouter (supprimé par automation par la suite)

kubectl get crds | grep monitoring
Résultat: aucune ligne