Monitoring#
Prerequisites#
Inputs#
export GIT_PATH="$HOME/git/"
export ZONE_NAME="..."
export CLOUD_ZONE_NAME="ocb-..."
Communication sur #operations_et_incidents#
Début du démantélement de l'outillage Caascad sur ${ZONE_NAME}.
Mise en place des silences#
amtool-caascad silence add cc_prom_source="${ZONE_NAME}" obs_client="${CLOUD_ZONE_NAME} --author "Caascad Team" --duration "14d" --comment "Decom : ${ZONE_NAME}" --alertmanager.url ${ZONE_NAME}/caascad
amtool-caascad silence add cc_prom_source="${ZONE_NAME}" obs_client="${CLOUD_ZONE_NAME} --author "Caascad Team" --duration "14d" --comment "Decom : ${ZONE_NAME}" --alertmanager.url ${ZONE_NAME}/client
amtool-caascad silence add alertname="RancherClientUnreachable" target_cluster="${ZONE_NAME} --author "Caascad Team" --duration "14d" --comment "Decom : ${ZONE_NAME}" --alertmanager.url ${ZONE_NAME}/caascad
amtool-caascad silence add cc_prom_source="${ZONE_NAME}" alertname="BillingClientMetricAbsent" --author "Caascad Team" --duration "14d" --comment "Decom : ${ZONE_NAME}" --alertmanager.url infra-prd/infra-consumption
Opérations sur les clusters clients#
kswitch ${ZONE_NAME}
Monitoring#
Désinstallation des charts Kube-Prometheus-Stack / Prometheus-Operator (permet de supprimer des services dans kube-system) :
helm uninstall -n caascad-monitoring monitoring
helm uninstall -n caascad-monitoring prometheus-operator
Suppression du service caascad-prometheus-kubelet (non géré par helm, géré par Prometheus-Operator) :
kubectl delete svc -n kube-system caascad-prometheus-kubelet
Suppression du namespace caascad-monitoring :
kubectl delete ns caascad-monitoring
Logging#
Suppression du namespace caascad-logging :
kubectl delete ns caascad-logging
CRDs Prometheus-Operator#
helm uninstall -n kube-system prometheus-operator-crds
Vérifications#
kubectl get all -A | grep caascad
kubectl get crds | grep monitoring